{"as_of":"2026-08-18T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7aae0223adfeaa63bf488f68b63888c112f78b21418f3f2ad9ad32c885a4b258","coverage":[{"denominator":91,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":91,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:34:03.890212Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.17999/citation-record","integrity":"/paper/2504.17999/integrity","json":"/paper/2504.17999/citation-record.json","paper":"/paper/2504.17999"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.494454Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.494454Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:fe826ac12bca05870f76fc292e73cf2e71c96b10d9b8954d025cc84b9c38b640","observation_id":"6b28980d-ff19-4fbf-bb82-ebed2eff3740","resolution":{"observed_at":"2026-08-16T10:34:03.494454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.499501Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.499501Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:893633a0667323f0940e77a1d06fe3dae089bcfd4a96937d57a46bbe3f225ab0","observation_id":"d2988f04-2835-4d9d-a73f-1d649923933b","resolution":{"observed_at":"2026-08-16T10:34:03.499501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.504118Z","title":"Basili and David H","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.504118Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:882f758a3ac32a723061a777efaa79b9ad828eb094d650dcd5667d9bc3d4ce56","observation_id":"46c44386-98af-4938-bd8e-b5a69afb92d5","resolution":{"observed_at":"2026-08-16T10:34:03.504118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.508780Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.508780Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:324dde97db97011b973d40c47751008abc11d3430b9074781e1bbc2fd227631b","observation_id":"e10f422d-70c8-4f1f-8e4a-da580fc93927","resolution":{"observed_at":"2026-08-16T10:34:03.508780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17098","last_updated":"2025-08-31T22:34:34Z","snapshot_observed_at":"2026-08-16T13:57:42.532680Z","submitted_at":"2024-04-26T01:17:06Z","title":"CLARE: Cognitive Load Assessment in REaltime with Multimodal Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17098","snapshot_observed_at":"2026-08-16T10:34:03.513182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.513182Z"},"links":{"cited_paper":"/paper/2404.17098","citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:5da17b2b33c293e9c5fd8d8e232cab95da0472e7d3d8ffcd571880dfd65369f9","observation_id":"748349f0-7c53-4746-aaa8-53de0fbe9458","resolution":{"observed_at":"2026-08-16T10:34:03.513182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.517845Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.517845Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:47cd5813537f428d68b9ddc28581bb7abb178f9cd664f9a3bd6b8d69cf39800a","observation_id":"466ed688-ae0d-48b3-9493-2bdfb3cb587b","resolution":{"observed_at":"2026-08-16T10:34:03.517845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.522976Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.522976Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:54596d07c62c66b4ece3d9606159c803503f37c5eb7a35047cee1f87e7d1f64b","observation_id":"585fde34-c133-410b-973d-bd137b4ad3da","resolution":{"observed_at":"2026-08-16T10:34:03.522976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.527451Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.527451Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:99b9cceadf98ad3655e7252111758c53e6cfad573a5b8d59e7724905636a0438","observation_id":"f39196ef-bf30-4fd9-95f1-4ba650098e4a","resolution":{"observed_at":"2026-08-16T10:34:03.527451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.531785Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.531785Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:005202e96234039aa6cf49db83abcb9a287150be9f096526695fe0e9f1be38ac","observation_id":"81e3d12d-9b31-4a14-8447-a5c988ed1653","resolution":{"observed_at":"2026-08-16T10:34:03.531785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.535971Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.535971Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:0944b5f14403453bac996616ccf0a20025212849c898b18e8b487e9e59613488","observation_id":"ab8559a2-ac78-46d8-bb01-ac8f1c0f2d5e","resolution":{"observed_at":"2026-08-16T10:34:03.535971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.540227Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.540227Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c8b58a0e094f51c75e7fb6fa8d08145b8bb2b1cf9da636a3b050be65cdd90418","observation_id":"99059232-287e-4973-9108-94b552af3ee2","resolution":{"observed_at":"2026-08-16T10:34:03.540227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.544794Z","title":null,"venue":null,"work_id":null,"year":1949},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.544794Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:7aa111c481c5660fd3ae9d0953109b5de0bf42179e64d67d83f05351d43e4289","observation_id":"1e9bfbae-e8f8-4b8d-a5fc-4545092900be","resolution":{"observed_at":"2026-08-16T10:34:03.544794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.277713Z","title":null,"venue":null,"work_id":"0b4895c5-c04d-43ab-8846-8d11ac2ea863","year":2016},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.549123Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:6e3054a82a34fd52d2e41b550af497038dcd54f6bd358f4ae13e1713de45351d","observation_id":"87ae05e9-80dc-40ce-a52a-796d5430be51","resolution":{"observed_at":"2026-08-16T10:34:05.282369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.263449Z","title":null,"venue":null,"work_id":"d6db0c16-c739-48e0-921c-307f8efed317","year":2007},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.553359Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:79df23330dc84857b91f36bf62e47f89fe88e0412e9687f5e5bfe5db9e45cb84","observation_id":"0f81c98c-2ec1-47fd-8690-0e2a9cc0f932","resolution":{"observed_at":"2026-08-16T10:34:05.267798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.557483Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.557483Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:5d32a39f705dadee2c415395d7efb637b45f702441fd52cd7492cb4f914b934a","observation_id":"f17fc6a2-201c-431a-87e7-1be4fa87cf66","resolution":{"observed_at":"2026-08-16T10:34:03.557483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.238415Z","title":null,"venue":null,"work_id":"c303495c-68b4-4564-aa43-dd3b9433d1ce","year":2012},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.561858Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:a7bfd67e6e410e49176daa3525f38ef6cb7605b3a6942433cd029d76c9b2c8aa","observation_id":"2ea61a64-403b-487d-ad16-6b2637f8b25f","resolution":{"observed_at":"2026-08-16T10:34:05.242986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.223184Z","title":null,"venue":null,"work_id":"a081a2db-7489-485a-8289-d0ed11484655","year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.566577Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:a336536de6d6382bfe0596b532acd784cb52b58b280b1508261e868705505703","observation_id":"0f28819b-6884-488a-b02b-0d235fc21ac0","resolution":{"observed_at":"2026-08-16T10:34:05.227878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.206734Z","title":null,"venue":null,"work_id":"4be8034c-fdac-46cf-b6f0-fef75c179500","year":2022},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.570930Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:745846692136bc61759baa3d839ed5edaf2059e8e774936f99e7957fb147fac5","observation_id":"9c80b679-a47c-410c-a45d-8876b8fdb32c","resolution":{"observed_at":"2026-08-16T10:34:05.211982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.190284Z","title":null,"venue":null,"work_id":"978ed5c3-0fa3-46a1-8be6-1e4ebd8ea7a3","year":2001},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.575455Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:e43d01ef7d962ea87029c2f69dff9f5f54f1a785a7b73dc384cf771fbdc04b39","observation_id":"3f0631ef-7484-4546-9494-4075d0a5fafd","resolution":{"observed_at":"2026-08-16T10:34:05.194541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.176843Z","title":null,"venue":null,"work_id":"7bca0674-f5b8-40c5-85f5-3f54ae218e9a","year":2020},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.580030Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:3022f8fab1d0bf97d72f1df02edb310b2bafb3a5cdf54805b4e7582fc3f74d6c","observation_id":"e9b145b9-2447-4a31-9162-9155c1cb3eb8","resolution":{"observed_at":"2026-08-16T10:34:05.181126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.162688Z","title":null,"venue":null,"work_id":"2890dc59-fa1b-43fd-81e1-57bb8804fe36","year":2001},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.584364Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:0f703621fb7922a27ccaffec2660a41e7dfac793f16b38405b33a72db733daf0","observation_id":"fc548e68-0f7a-4589-aacd-5ea0563ee3cb","resolution":{"observed_at":"2026-08-16T10:34:05.167211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.146804Z","title":null,"venue":null,"work_id":"6d830814-f33f-4003-9386-fa53719c65e3","year":2012},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.588514Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:746865f3b41b8207db18fa91e083f44dcd720ae325bc74bc0a77dcf0a4a61c30","observation_id":"adb9e26e-85b8-4ccb-95da-db30d24863c2","resolution":{"observed_at":"2026-08-16T10:34:05.151540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.131592Z","title":null,"venue":null,"work_id":"bbd7ae43-160b-4d1f-a6a3-e1be707b11c6","year":2015},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.592848Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:9a95884052157169e1e42e2733ce3495c4e9f3ef84599b80a2d35a58a46beb1b","observation_id":"334093ca-417e-45f2-a48b-a5a8a4d1c426","resolution":{"observed_at":"2026-08-16T10:34:05.136614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.597470Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.597470Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:dac4e96887f6fb7d0ea892a972c3d29864d2c6474e2ff8b5fc2ea40d30eddd73","observation_id":"e481c3cf-8b8a-4245-bc62-c141098734bf","resolution":{"observed_at":"2026-08-16T10:34:03.597470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.107883Z","title":null,"venue":null,"work_id":"29057b14-2ea0-4190-b048-d3b3026608d4","year":null},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.601867Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:e569217341591c06a24505cb67c3d340f59c252d82043acf869dc4f06f0c6225","observation_id":"ddf11c5b-0eec-4b7a-b744-29800c7024c7","resolution":{"observed_at":"2026-08-16T10:34:05.112352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.078656Z","title":null,"venue":null,"work_id":"55fe127d-c865-4786-9066-4a13010eb9f7","year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.611173Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:bcabf7ddc96f660b08b6e78b1ce34d1a6170f9c5a6d1362d52752f19b82f2e9d","observation_id":"e3d60183-c4bb-45de-860f-d583df30d50b","resolution":{"observed_at":"2026-08-16T10:34:05.083529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-16T10:34:03.616166Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.616166Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:271ce11fc1de6b1619e179ae91e03086819ba0f6b52db13ba0c740530527bca0","observation_id":"7cd8854c-83d3-4363-bc3a-c80066a939f8","resolution":{"observed_at":"2026-08-16T10:34:03.616166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.065486Z","title":null,"venue":null,"work_id":"8f5ebca0-048a-44b1-a308-60f4b40baa97","year":1952},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.621142Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:6f821c339ffc1a2d48b87c0b7454ca8352278dcbe61f93339d55d0c588b2deeb","observation_id":"6394ed13-dddb-40d4-b942-86e3dcd8ba52","resolution":{"observed_at":"2026-08-16T10:34:05.069503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.051468Z","title":null,"venue":null,"work_id":"09a2c2b8-981c-4dbd-9168-31ad5565bafd","year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.625524Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:12f1a426bca2efb68a5709b9f100647a7132ef6e7de3b54915719fe19d5eaebc","observation_id":"3690687a-7408-4c21-a4c1-acd6f1734011","resolution":{"observed_at":"2026-08-16T10:34:05.055817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.036654Z","title":null,"venue":null,"work_id":"804248aa-d6bb-42a7-9a5e-2a28c475d03d","year":2018},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.629878Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:70b18932bb027c9af3707810476ce6b6716a0f2164976ef689253a8820f41cfc","observation_id":"5b740303-4acd-49ea-bec3-07fd410e307e","resolution":{"observed_at":"2026-08-16T10:34:05.041414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.022591Z","title":null,"venue":null,"work_id":"0de94c69-c1fb-4ad1-82d7-307f01aa08c6","year":2013},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.634139Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:36f32ac2cfa76d687db8ee66e563b39dba515b892d1658677026355e801a1e96","observation_id":"5f15fac7-f9fe-46e4-b11e-7757961d65cd","resolution":{"observed_at":"2026-08-16T10:34:05.027212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.007326Z","title":null,"venue":null,"work_id":"3b56f78b-f2f4-4f73-9779-dd72c091a3ae","year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.638518Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:6e9b4123d266b823a0f38f3957a1b945fd34fb0b40f27464e6d50e325f71d6eb","observation_id":"d5f26578-f666-4e9e-94bf-e8d594f7f440","resolution":{"observed_at":"2026-08-16T10:34:05.012457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.991435Z","title":"Brockmole, and Sidney K","venue":null,"work_id":"195b4638-c04c-4e66-804a-d76a86a50a5b","year":2021},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.643043Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:11b757a1721cb0b96e3d93a6dc5cc9fba2cd6611f78f6a3ebb1db0da76883391","observation_id":"aeb2544b-e3c4-4620-b32d-9a411748c8db","resolution":{"observed_at":"2026-08-16T10:34:04.996328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.977085Z","title":null,"venue":null,"work_id":"785a188e-f366-442a-a659-a8a04deefb9f","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.647406Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:10315b5ded400c12e98c9929ebe6148c5c259a6f4f3c82e6aae66f8e81ef9c24","observation_id":"718552d6-d416-4120-99af-ae3691ede8cc","resolution":{"observed_at":"2026-08-16T10:34:04.981518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.962254Z","title":null,"venue":null,"work_id":"a7c0c635-8181-4f54-9312-9b61aafa9471","year":2020},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.652066Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:ff7ec9cd1d320202c9619c69d3279e03d5787f444368b0e01fe3c13b639a2710","observation_id":"8e44f620-5e85-4592-a72b-5d27151291ae","resolution":{"observed_at":"2026-08-16T10:34:04.967187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.946647Z","title":null,"venue":null,"work_id":"978e6fd0-39e4-45b9-9e31-8b90cbbc8d53","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.656160Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:3cac438f053e04c051d636fdf73726fa132c30f10a4c4ea730ecf1c0010ef530","observation_id":"0cd7f69f-4220-49a4-94e5-2b54639daa57","resolution":{"observed_at":"2026-08-16T10:34:04.952162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.931979Z","title":null,"venue":null,"work_id":"aabf93d4-6a48-4df1-a4f9-f3c6e1ef9c29","year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.660519Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:8c46f472224f260ccc2b42ac42df75bd65ee50aeee9f9f4bb6a8d213430e4e13","observation_id":"a6a4845b-ca81-4e33-9444-e73bb082cfa0","resolution":{"observed_at":"2026-08-16T10:34:04.936621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.664653Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.664653Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:4a973eb64b4d15b9737e5d3cd389f1f9fab9faf8420ff3217ddeb7d23d12658e","observation_id":"a5dd7d9b-c723-4679-a87f-a66a1ecbf6a9","resolution":{"observed_at":"2026-08-16T10:34:03.664653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.898629Z","title":null,"venue":null,"work_id":"87c8f403-6996-4fe2-bbc1-089826be284c","year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.673127Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c7b368633c4aa62044f3726356ee580eb78332516475d3f6ebbd4a3019edcf06","observation_id":"65c4c4a4-5be9-450f-ae4b-89389b073262","resolution":{"observed_at":"2026-08-16T10:34:04.903264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.883484Z","title":null,"venue":null,"work_id":"045d8454-f590-450d-96a5-fa2af391c681","year":2020},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.677504Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:3b8d7fb273b94103e1ef053e44fe74327605e9eed716ff4f7d695104bbd42c9e","observation_id":"b9cfdd04-29db-4809-a2f8-48033b2d8933","resolution":{"observed_at":"2026-08-16T10:34:04.887914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.869021Z","title":null,"venue":null,"work_id":"b9de6340-0bb8-4a6b-8255-8d81b2138f79","year":2016},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.681650Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:fc848a916bee0aac122387f958426893e4884a858e20cc23752b5ef182a5d871","observation_id":"93e048f8-110b-480c-ba02-4648fe7c887b","resolution":{"observed_at":"2026-08-16T10:34:04.873532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.854952Z","title":null,"venue":null,"work_id":"f90ea295-97ed-4ef1-9f64-04bad4416d25","year":2001},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.685815Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:0adea8328d56f183b95bc53401ca5ed0d9eb7a8ee3c65970703a60ce252d1a4f","observation_id":"efa54d6a-0b63-4361-90d7-6c4c2c130f19","resolution":{"observed_at":"2026-08-16T10:34:04.859301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.690350Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.690350Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:82ce46857a1f984e2884880f00fe99aa1257059007f554413c6800c9032ac773","observation_id":"35997efc-3951-438b-af23-84069b45d7fb","resolution":{"observed_at":"2026-08-16T10:34:03.690350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.830569Z","title":null,"venue":null,"work_id":"cbe50336-0e3d-4ee0-aaa7-1884e339f0b8","year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.694631Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:7bfaec6504ab5b071b829c9401625c84e1480ef87d7d5690bdf09de0e7cc5367","observation_id":"10f7c378-87c7-4f6a-9c50-5f39abab41a8","resolution":{"observed_at":"2026-08-16T10:34:04.835290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.816503Z","title":null,"venue":null,"work_id":"e175224a-791d-4b49-b72b-a7d16de3d3da","year":2015},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.698948Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:3ca678ddf2d3e28b76cd822301dd3640839053d7e47bc0b8ecd62ef2d5ee91ed","observation_id":"6e90c27f-0417-4ac9-9d16-0eb6a7e9be00","resolution":{"observed_at":"2026-08-16T10:34:04.821151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.802690Z","title":null,"venue":null,"work_id":"7c66ca96-d187-41f5-ac52-0bb1849b6fa7","year":2015},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.703441Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:5698a818632fd435534aab8bd806e48799f616297a8101eae383675f35fdfd61","observation_id":"2e425df0-7141-411f-9e0b-ac112a155577","resolution":{"observed_at":"2026-08-16T10:34:04.807233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.788261Z","title":null,"venue":null,"work_id":"ca02f850-d08b-470b-82f6-043e5808f4db","year":2010},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.707750Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:1d9b421950384143c7daac7af02e58b7097c6c535172daf4c4d521704c3ca17a","observation_id":"11d7cef4-1a34-4ea9-8933-73fb27515e91","resolution":{"observed_at":"2026-08-16T10:34:04.792734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.773520Z","title":null,"venue":null,"work_id":"8168639a-cf4c-4d5f-a225-6c494cef9798","year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.712259Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:df76197da9211a8042edf8490ae4b2244d0d47db709ce985e76c2bd3c7ec571c","observation_id":"6ce71064-4779-4693-baa2-2943b3befd8e","resolution":{"observed_at":"2026-08-16T10:34:04.777947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12162","last_updated":"2025-05-17T07:09:10Z","snapshot_observed_at":"2026-08-14T19:50:19.511079Z","submitted_at":"2025-01-21T14:15:01Z","title":"AdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12162","snapshot_observed_at":"2026-08-16T10:34:03.716435Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.716435Z"},"links":{"cited_paper":"/paper/2501.12162","citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:759cf3d4d80e81c5270442c9746071108e927bc13609d0d7ede07249a70de98a","observation_id":"678203a2-397d-4821-b955-561c63590c6e","resolution":{"observed_at":"2026-08-16T10:34:03.716435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18695","last_updated":"2024-12-24T22:51:29Z","snapshot_observed_at":"2026-08-14T11:31:19.822343Z","submitted_at":"2024-12-24T22:51:29Z","title":"TimelyLLM: Segmented LLM Serving System for Time-sensitive Robotic Applications","version":1},"cited_work":{"arxiv_id":"2412.18695","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18695","snapshot_observed_at":"2026-08-16T10:34:04.215036Z","title":"TimelyLLM: Segmented LLM Serving System for Time-sensitive Robotic Applications","venue":"cs.RO","work_id":"694b0ca4-fd07-4b87-b110-e92c0a33b8db","year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.721784Z"},"links":{"cited_paper":"/paper/2412.18695","citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c3a2544764916d870565f741656b2e9eff3abdf3814a8783dcb2d6660b0efd92","observation_id":"9c6ce41c-e02b-44ff-a253-cf3d7a6a9fa8","resolution":{"observed_at":"2026-08-16T10:34:04.221065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.759853Z","title":null,"venue":null,"work_id":"07ae929e-32f6-4a62-823f-b698cbdb256c","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.726506Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:4fa829762e562bc7d4dec671fed449690943a061cf11753ab1dfceb0360291b3","observation_id":"a50e864a-0314-439f-b6ef-0d8d74d116db","resolution":{"observed_at":"2026-08-16T10:34:04.764215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16283","last_updated":"2024-12-13T07:01:16Z","snapshot_observed_at":"2026-08-16T13:58:02.684989Z","submitted_at":"2024-04-25T01:56:00Z","title":"Andes: Defining and Enhancing Quality-of-Experience in LLM-Based Text Streaming Services","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16283","snapshot_observed_at":"2026-08-16T10:34:03.730745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.730745Z"},"links":{"cited_paper":"/paper/2404.16283","citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c45a2aac3352b505cdaef4f03f4e2682bbde777e434855b8dc8414edfc52e873","observation_id":"cf946c4e-0e81-4a10-aef7-07748e1123f5","resolution":{"observed_at":"2026-08-16T10:34:03.730745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.735427Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.735427Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:af778f23cbc570d70730d418fd68a2dedf4345f8e80a960d3834391ab6f8062d","observation_id":"a2349601-88da-4217-bf6d-c8068e41ab7e","resolution":{"observed_at":"2026-08-16T10:34:03.735427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.746086Z","title":null,"venue":null,"work_id":"ca8c82d8-f905-4c9e-a1e0-69d93864dc73","year":2001},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.739691Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:16ff649fa1de09746034a6b20251cbc5e94eba3ddc87e847ab3b4f3a79abd69a","observation_id":"4c79870b-9d69-43a9-87dd-3987b9a0633d","resolution":{"observed_at":"2026-08-16T10:34:04.750532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.732273Z","title":null,"venue":null,"work_id":"c33684d9-1124-4857-9f59-d61fb0894375","year":2018},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.743946Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:b971bb28b4d619048463a26d462b2a391787386955c11e2ab34b7f956df94480","observation_id":"4c925e66-4b1b-4dbe-9503-3495137aa530","resolution":{"observed_at":"2026-08-16T10:34:04.736546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.717997Z","title":null,"venue":null,"work_id":"1eabd53d-ce97-4cf2-962a-df326009bfb5","year":2017},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.748028Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:89c25bbb342abe610f41c3d090db95c5eef5e69d3aca47077ee076d82469ad44","observation_id":"092ebf4d-abd8-4017-92cc-30cac48ae547","resolution":{"observed_at":"2026-08-16T10:34:04.722324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.704322Z","title":null,"venue":null,"work_id":"496cdf0d-3775-4084-80e4-52b649f082af","year":2015},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.752073Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:2833323480e5c16fd8d9da0a76249df1b54ef1e5d4be36dc7f43b057402b8381","observation_id":"51835ea6-d26d-4615-97bc-ede4dbf5dcb9","resolution":{"observed_at":"2026-08-16T10:34:04.708687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.756517Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.756517Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:2328079918db35a974153d01b5e8a6315f9581e6bafd34951b6bf577344f0550","observation_id":"b7539255-fa77-452e-b138-6eed224fdfe1","resolution":{"observed_at":"2026-08-16T10:34:03.756517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.688205Z","title":null,"venue":null,"work_id":"ba722650-f68b-41b7-a56c-695f49baa372","year":2001},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.760590Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:446d6f82a99f9bba66e2594d5d28cd466350587f28686e61dc19e8c2c94bb6b1","observation_id":"909051ff-3018-4ba2-96f2-17ca4e446b78","resolution":{"observed_at":"2026-08-16T10:34:04.693364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.673269Z","title":null,"venue":null,"work_id":"ff78c8b7-4321-4031-892c-d47ef2d2bf33","year":2003},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.764681Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:0294b89936c27f4c4816821767b668d69cc9d0f71a3a8a91d53e94476798a72c","observation_id":"7e9ee9bc-4819-4008-b730-fde515f9a998","resolution":{"observed_at":"2026-08-16T10:34:04.677828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.658745Z","title":null,"venue":null,"work_id":"6ae0885f-e9a5-4b2a-b2a5-e58311aa5f0f","year":2007},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.768768Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:d596179395d43d6bd684c957e28caeccb8cb2a0895133ed8311fc9223e375b84","observation_id":"1ebc70e5-21c9-4a18-bd62-153edd21f199","resolution":{"observed_at":"2026-08-16T10:34:04.663356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.643063Z","title":null,"venue":null,"work_id":"607ec51f-74ce-4b86-973f-fbee5cc07aa8","year":2023},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.773069Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:bb2555af65bfdb91f60ed62cd22af784842c98277e6165d63163de9e2308cdfe","observation_id":"53fcc78f-c358-47ae-9d3d-0da7d4e5341f","resolution":{"observed_at":"2026-08-16T10:34:04.647896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.628295Z","title":null,"venue":null,"work_id":"0a9013bd-049b-4847-b2ad-c0c580c93351","year":2014},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.777191Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:a721191a21d173c38438f5cbbc8b88545251def4413ddcce01d86078ea2c65b5","observation_id":"910b7aa7-cf95-4214-9035-1f73bebb7534","resolution":{"observed_at":"2026-08-16T10:34:04.632833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.613349Z","title":null,"venue":null,"work_id":"e6a476f2-b2ed-4861-916a-34038090a458","year":2010},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.781603Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:9b5f20f04510d0cd990c43ba69fe0668d1a03502d02f8570da824194988ffd8f","observation_id":"145fd12a-50a9-401c-ad60-b1f7561969a7","resolution":{"observed_at":"2026-08-16T10:34:04.617895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.785732Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.785732Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:2f544e4aa1f3a712b270fc7c0252535e32d9c77c4d614e758df4c479c8609565","observation_id":"2d3c8bc3-1773-4ff5-973b-363a933a5544","resolution":{"observed_at":"2026-08-16T10:34:03.785732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.588790Z","title":null,"venue":null,"work_id":"7dd5df4a-ddb2-4e82-af75-ef4b97b59445","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.790559Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c06729fc2f66d7d62c12d3c7aa317f96faa9f5e0259dd9f88731978e85cbf372","observation_id":"49395876-6c4d-4621-a993-cf811acabff5","resolution":{"observed_at":"2026-08-16T10:34:04.593178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.574620Z","title":null,"venue":null,"work_id":"cd93ede1-a9bd-466b-9e4e-2db40444534d","year":2016},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.794991Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:3f2e788b4dad1d5db0dfab8d8bf311e3a02000f17ccc5d8de84f097c39d0380f","observation_id":"3b869e6a-59a5-4514-ad35-efdc96d57c14","resolution":{"observed_at":"2026-08-16T10:34:04.579268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.560440Z","title":null,"venue":null,"work_id":"ee624ec9-76fb-482f-962d-d735dc5fb93a","year":2000},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.799475Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:1d3b52ca207d30b59cf91ad5856d8b90375a501244df5a0fb02ae3d673e5cab5","observation_id":"e24b0d4e-4956-4800-981a-4199d101c50a","resolution":{"observed_at":"2026-08-16T10:34:04.565067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.803772Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.803772Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:8f0c84cbb367507e4ed802860d00c09517e5002af49b06699762912fab91696f","observation_id":"997d1b23-6e5a-45a7-b386-e6b42c449758","resolution":{"observed_at":"2026-08-16T10:34:03.803772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.534887Z","title":null,"venue":null,"work_id":"e4bf3121-5069-4cee-8f5b-8e757965c50b","year":1993},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.808094Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c9982d1c7b9056c3d1173419c304805c7f86af235828dc54a05dd855064effeb","observation_id":"e9620277-555a-4818-9dee-a92f31fef984","resolution":{"observed_at":"2026-08-16T10:34:04.539933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.520142Z","title":null,"venue":null,"work_id":"ee2f59b4-cf63-4ea5-bdaf-2adb3e4fe551","year":2016},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.812287Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:487b9a9a07e501e15d486551a4b7a7b18118828f336c00c7dd93896641e4c253","observation_id":"18e5ea57-0742-4221-8194-b32734bb144c","resolution":{"observed_at":"2026-08-16T10:34:04.524512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.505305Z","title":null,"venue":null,"work_id":"7e3dc416-4b53-41ff-9866-01fcb8446271","year":2005},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.816394Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:a137e277b2b1d0c2e2edfd9f8b8711b66f18f62094910b8c393238079c8de7df","observation_id":"ee74429f-1196-4ff4-9caf-0844d2451aa9","resolution":{"observed_at":"2026-08-16T10:34:04.509879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.490353Z","title":null,"venue":null,"work_id":"570515dd-3722-47f3-b6af-8f8b80c2ec68","year":2012},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.820651Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:c151079430011635b57183018cb9a0a5f1dc7c9390aca07136c87956fba37322","observation_id":"02f70d17-0e88-4f11-af88-aac5a431d439","resolution":{"observed_at":"2026-08-16T10:34:04.494932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.476108Z","title":null,"venue":null,"work_id":"3375f7b8-a763-4f5c-9ccb-34aad160de30","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.824996Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:9b87bc228a0a63a2626a87463dfd92610091b7e59942df295942921db8bc8ed4","observation_id":"868b5701-dc57-43fd-9768-7b89b27abbbc","resolution":{"observed_at":"2026-08-16T10:34:04.480545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.461088Z","title":null,"venue":null,"work_id":"b35002f1-14b2-45ca-a844-2576c3670855","year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.829269Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:9b90fde0192bf0ba5fdcb14a0ac5e984501b583cacf943d7817a18f0a3d71360","observation_id":"e459a073-10fa-4e6f-a538-71d0205301da","resolution":{"observed_at":"2026-08-16T10:34:04.465926Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.833287Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.833287Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:fdd2ef4db78eff52363c8178003d7ce1c6445a1720728a3b717a46d2ff6dbd49","observation_id":"1677baf1-ab43-42f5-86fe-5aded552d649","resolution":{"observed_at":"2026-08-16T10:34:03.833287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.436576Z","title":null,"venue":null,"work_id":"b7afc481-ec9a-4669-a940-6ed24ac7f6b0","year":2019},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.837254Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:3f832a2527f1f812de426a579c4e379ce0f28cf7a517d4bcf311094450df4694","observation_id":"45734e27-2eb1-47ef-bdc7-39556be66f30","resolution":{"observed_at":"2026-08-16T10:34:04.441347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.422065Z","title":null,"venue":null,"work_id":"dbe120ea-4ed6-4d0d-a862-e96163996173","year":1967},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.841823Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:678f60cb0c2cb0e0b6dd2ea8b71953bb828ae152dc70fc3b51e6c3a07f345107","observation_id":"67e23a4e-7a1f-463d-ba55-510604f6290b","resolution":{"observed_at":"2026-08-16T10:34:04.426542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"articleshow/1197544","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.997387Z","title":null,"venue":null,"work_id":"bd571fcf-ba1b-4aab-a80f-5f22116fd85d","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.846271Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:9a4e18091ab218864996e59f3616d322fcd398121108efdbc9cdcffe5a30ab6e","observation_id":"368ba687-4948-4e24-9663-57a740fb6357","resolution":{"observed_at":"2026-08-16T10:34:04.005823Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.407567Z","title":null,"venue":null,"work_id":"a47a9fe1-2d90-4b29-8275-e03f3f8fb664","year":2018},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.850800Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:e9b330704be9962063c3345903bdb14c3b7f9c600e65a6958aae8ac82fb99cd7","observation_id":"83eb4d31-1653-45f8-9de3-98bc81276a21","resolution":{"observed_at":"2026-08-16T10:34:04.412211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.391432Z","title":null,"venue":null,"work_id":"3c40cf5a-589b-40dd-a8fa-2fba41803f62","year":2012},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.855289Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:b5b4385b782cff7d80ac561bedf7002034d322a142d8ed89f612b5b8470f6e2b","observation_id":"63eefc17-7efb-46e9-91af-e47ca4071af6","resolution":{"observed_at":"2026-08-16T10:34:04.396578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.375045Z","title":null,"venue":null,"work_id":"638572a6-dfa8-40a3-abd0-433c8615835d","year":2024},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.859877Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:7b201f81f4d8724867497fe481eef07842fa50326f4f111f126a64ed543bfbf8","observation_id":"c7691cdc-604e-4d61-8c42-81d444e2eb25","resolution":{"observed_at":"2026-08-16T10:34:04.379995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.360106Z","title":null,"venue":null,"work_id":"83b7c617-f3e0-4149-a9bf-4e8874f92056","year":2022},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.864343Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:31aa390c15ba91edc17530f540333c3e280e435a853ed369ddd0a9554021a21c","observation_id":"d92da402-354c-4d80-96c5-079e54de9f45","resolution":{"observed_at":"2026-08-16T10:34:04.364539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.344809Z","title":null,"venue":null,"work_id":"5f83ec8b-c142-4664-b5d0-b78e6b127ffe","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.868744Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:acc0eea468aff944c8bbc6d2b8d7ef499512907a286d3c6f59594c7b51af725e","observation_id":"b77a97da-8e2d-4b43-af9b-a19432dc7aee","resolution":{"observed_at":"2026-08-16T10:34:04.349737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.329850Z","title":null,"venue":null,"work_id":"5ed0cfbb-fb7f-46eb-8a87-5559a4e325de","year":2015},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.873103Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:00f1a4e5882b79c1b905614ec5eb7eca8b0a36ddbff05c94eca144ff31607459","observation_id":"9df909ce-506d-4475-b0b9-af0147307a1c","resolution":{"observed_at":"2026-08-16T10:34:04.334536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.315798Z","title":null,"venue":null,"work_id":"e5927f63-e75d-40e9-8238-6f6f47c4866f","year":2013},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.877362Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:15fa2550fca53a5750e2554bd06335a40c5a00afd5dedd2550d683f80c9b9686","observation_id":"8b9a7544-6b7c-4580-bfe2-a6b4f695409c","resolution":{"observed_at":"2026-08-16T10:34:04.320001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.881897Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.881897Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:8b4df1f01b43a9e1d1fd10e16e9b14ef03173d1493cc755dc3bbe069a0ac5b88","observation_id":"a1a28d13-4aaf-4afb-8d20-de5c57dcf4cc","resolution":{"observed_at":"2026-08-16T10:34:03.881897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.291035Z","title":null,"venue":null,"work_id":"9a0f6718-937c-42de-96fa-a92fead59b91","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.886085Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:a0af0db385c213457ede2ea175246dc62ce7d717a251c580ddbfe27d9ad23f0c","observation_id":"8b32661a-4024-44a7-aa5d-6f85ebf23e0c","resolution":{"observed_at":"2026-08-16T10:34:04.295540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:04.275613Z","title":null,"venue":null,"work_id":"2209f6a1-e962-4a34-99f5-4b7b816e1508","year":2025},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.890212Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:93356fe4b81d877825996255d05776bc38f0f7a638e6895696cffcb755f5db83","observation_id":"0d38fb00-eed5-439c-808d-9959fbd307a8","resolution":{"observed_at":"2026-08-16T10:34:04.280460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:03.669017Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":1975,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.669017Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:7cd07de04e82b2019e5097d6d48347d1e217b3cd2692280eb61b8a97ade9360e","observation_id":"7b5d96cf-2f9c-474d-93f1-9e68a05bc840","resolution":{"observed_at":"2026-08-16T10:34:03.669017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:05.092947Z","title":"Behavior research methods, instruments, & computers 36, 2 (2004), 193–202","venue":null,"work_id":"2233a7f7-3821-4f5c-9b65-833e74761851","year":2004},"citing_paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving","version":2},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:03.606529Z"},"links":{"citing_paper":"/paper/2504.17999"},"observation_digest":"sha256:7ba85ebb359d0dcc8367834698feaf429cfaba17aff9b9c6dd996aec04d29bd6","observation_id":"b0c5fe4c-2b05-4a41-b806-ca0f9b3e445f","resolution":{"observed_at":"2026-08-16T10:34:05.097625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.17999","last_updated":"2025-07-23T18:50:43Z","latest_version":2,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-18T13:33:26.729663Z","submitted_at":"2025-04-25T00:58:37Z","title":"Streaming, Fast and Slow: Cognitive Load-Aware Streaming for Efficient LLM Serving"},"reference_resolution":{"displayed":91,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":87,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":91},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 91 of 91 outbound references and 0 inbound Pith citation observations for arXiv:2504.17999."}