{"as_of":"2026-08-06T21:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b22a390f0d8d7aa856b8036e2dd7df466a39fd9ed789a5da9e27446448c719ea","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T07:42:36.852261Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.27747/citation-record","integrity":"/paper/2604.27747/integrity","json":"/paper/2604.27747/citation-record.json","paper":"/paper/2604.27747"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.03236","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T20:07:21.874626Z","title":"arXiv preprint arXiv:2509.03236 , year=","venue":null,"work_id":"70abc516-1c36-4952-9a48-60b396c6e685","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:35ac7fb1e83fe67aa6d6845de1a995407a120e05aa26612df975bfaf52a3338c","observation_id":"ecd621d7-e368-4333-8ae5-93293caad541","resolution":{"observed_at":"2026-05-12T10:06:29.872890Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18965","last_updated":"2025-02-26T09:25:10Z","snapshot_observed_at":"2026-07-06T20:42:55.911327Z","submitted_at":"2025-02-26T09:25:10Z","title":"OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment","version":1},"cited_work":{"arxiv_id":"2502.18965","doi":"10.48550/arxiv.2502.18965","metadata_source":"pith","pith_arxiv_id":"2502.18965","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment","venue":"cs.IR","work_id":"d1a07d92-e045-4af2-a79f-c7b0112cf824","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2502.18965","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:c841820c5d74d2e6026a251690f8619d0713eaac32723a81fcc8755b1a1ac596","observation_id":"fe900949-ae80-4c7b-95c3-6a140dfc5d45","resolution":{"observed_at":"2026-05-12T18:30:36.120082Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T20:53:23.201732+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T20:53:23.201732+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dlcrec: A novel approach for managing diversity in llm-based recommender systems","venue":null,"work_id":"9c25eccf-2d32-4581-bee8-3c170ead9c75","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:2b1e0331185c29a179c4c41615ef6d030bd6f1501b46e0eeeedfdf3d85901c53","observation_id":"34d86ddc-4448-4692-8736-ebda98ad9261","resolution":{"observed_at":"2026-05-27T09:28:54.153021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knowledge-enhanced con- versational recommendation via transformer-based sequential modeling","venue":null,"work_id":"fdc66b1e-7583-40d3-8b1b-172304fc28f5","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:08288050d8b8e8790eb97ec1ecf0ec2e8cc4e8ff2633c5e642f69b6419e7d990","observation_id":"05c500de-309d-4449-9a99-1ecb9532bbdf","resolution":{"observed_at":"2026-05-27T09:28:54.146740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.11524","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoding in latent spaces for efficient inference in llm-based recommendation","venue":null,"work_id":"560aa844-6278-45ca-9efd-7873a343946a","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:828895e5958d2b7f38e6de0b1d0c7e5c8f9b4a08f836b629592a31e103752d12","observation_id":"81f784fe-558c-4c0d-be42-b7ccf3609845","resolution":{"observed_at":"2026-05-12T10:06:29.855506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient inference for large language model-based generative recommendation","venue":null,"work_id":"6fd3a165-ac27-4ffb-84be-dbc7a2eef578","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:7e930db12cbf2f686e45f2cdee41412f99d35272891e8d67d4363f3b472fd9ed","observation_id":"4ed9aa09-4465-4552-b0a7-7a6a6e9858b4","resolution":{"observed_at":"2026-05-27T09:28:54.269224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficiency unleashed: Inference acceleration for llm-based recommender systems with speculative decoding","venue":null,"work_id":"2c6b420c-b6ab-41e9-9760-2821caedbe27","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:256e9eaee446ae6789e6488693161cfbb7d8d632f91b039793ad7f2cbb0335da","observation_id":"66a6b10b-2912-40d9-98bd-1fb57cd933ed","resolution":{"observed_at":"2026-05-27T09:28:54.137408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:04:14.714232Z","title":"Fast inference from transform- ers via speculative decoding","venue":null,"work_id":"5b6a501d-36aa-4d70-a7fc-73a08d3150b5","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:d36891eb6838557885d195d69375c7b354d300f76665adfb8fa7b61484552e71","observation_id":"78111f0a-7d0a-47d0-b84e-cc83e83f5b69","resolution":{"observed_at":"2026-05-27T09:28:54.255101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-07-06T12:54:54.273968Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":"2203.16487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lossless speedup of autoregressive translation with generalized aggressive decoding","venue":null,"work_id":"71daad25-1bfb-46ba-9f69-d35c09750357","year":2022},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:3da8f233392dd9218e439c58a57703190ccbf7efd2dd15ec69626fc9ae8ae393","observation_id":"52d294ab-ba12-4e7c-9c26-463ec80f03b4","resolution":{"observed_at":"2026-05-12T10:06:29.908758Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":"22e5f0bf-9602-4b7a-905a-570bdcaa8fa4","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:873ea4aa2090dccb5119f77dddc75a1bd1f034fb5580d5aca87eb3fa5404c7b1","observation_id":"0023b997-b4a0-478d-99b5-92a106d8ed04","resolution":{"observed_at":"2026-05-27T09:28:54.286173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":"2302.01318","doi":"10.48550/arxiv.2302.01318","metadata_source":"pith","pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","venue":"cs.CL","work_id":"b53b11e5-8613-439d-9d9d-0e2a9090d79f","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:c8f2534739fdad2c7e8899e63da685f9080ff65d068f92bd1c29e0365bd029fd","observation_id":"d04f00d6-ec81-44b4-9f0a-3f9a4c10f530","resolution":{"observed_at":"2026-05-12T10:06:29.891667Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:04:14.764801Z","title":"Specinfer: Accelerating large language model serving with tree-based speculative inference and ver- ification","venue":null,"work_id":"4ce2091f-ba46-4cb7-b03c-9d5d9e654811","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:b22ae11dec22f7e4fd42c28fe66619383c1e5516f12df48736a17a695358b28d","observation_id":"ee4d2755-e4e4-451c-a62b-6ad3bb613513","resolution":{"observed_at":"2026-05-27T09:28:54.250871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08461","last_updated":"2024-03-31T03:06:51Z","snapshot_observed_at":"2026-08-05T02:36:37.583362Z","submitted_at":"2023-10-12T16:21:04Z","title":"DistillSpec: Improving Speculative Decoding via Knowledge Distillation","version":2},"cited_work":{"arxiv_id":"2310.08461","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.08461","snapshot_observed_at":"2026-07-07T12:33:45.223304Z","title":"Distillspec: Improving speculative decoding via knowledge distillation","venue":"cs.CL","work_id":"5539a830-000f-41f0-9344-c030679cc16f","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2310.08461","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:0871144e2368209122f093ffadacde2ce5d2bb0157a3f306c310fe57863d3681","observation_id":"20436695-608a-40d5-901a-457577fd7c1c","resolution":{"observed_at":"2026-05-12T10:06:29.899708Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eagle: Speculative sampling requires rethinking feature uncertainty","venue":null,"work_id":"6e1b2c9c-4c05-4773-b63a-84019f32db22","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:5057ff644f9105d92b9f7d4b7b6c36db992867bf0d017c3dd4f29350c99bf48a","observation_id":"73990dbe-a379-461a-80b9-312fc25d7f16","resolution":{"observed_at":"2026-05-27T09:28:54.237330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning harmonized rep- resentations for speculative sampling","venue":null,"work_id":"28c3955d-11b6-48de-8f84-0c89a5dc868f","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:e061da2182622830e6d7c46c5c3c8994885cb7ebdc4e47394a7c442a4d1d0261","observation_id":"5ad440f3-6f73-45d7-8eda-bc97bc154366","resolution":{"observed_at":"2026-05-27T09:28:54.222469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tokenrec: Learning to tokenize id for llm-based generative recommendations","venue":null,"work_id":"530307aa-9f71-4d9f-aac8-740b1a8c2d4c","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:44e1429bf95f5896cfd877a9845e2acba5d8eba1bcc76cac66a514a8654f843b","observation_id":"1aa4c6c1-1440-4e4b-98e0-13489a045b1c","resolution":{"observed_at":"2026-05-27T09:28:54.205906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapting large language models by integrating collaborative semantics for recommendation","venue":null,"work_id":"9de1e419-432a-4d24-bc3a-50a6996c0430","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:098246fadb29e55041642706e15d1ac4955212e044e40d923ffe2b85a2bbbcd6","observation_id":"546e092e-6081-4435-a44f-5de73ae45449","resolution":{"observed_at":"2026-05-27T09:28:54.202444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autoregressive image generation using residual quantization","venue":null,"work_id":"e3470344-0e18-4ff8-a277-4b515b9ddd56","year":2022},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:8da1f087c11131f14b58b8aea6952804863f40d9c41a7c9b42ef638502ff128a","observation_id":"6d7b01e3-6c73-4fec-89a3-b6e686d4b8ba","resolution":{"observed_at":"2026-05-27T09:28:54.172514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:04:14.682577Z","title":"Blockwise parallel decoding for deep autoregressive models","venue":null,"work_id":"e24c0f5c-cabb-4a76-84fb-f0685bc0129a","year":2018},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:12beff6b16a61193a759d1c25baa48bc21d1250176ab4bf90d4ced8bbdb6e12d","observation_id":"12140ae8-0e99-41cd-8568-95d2d61d1740","resolution":{"observed_at":"2026-05-27T09:28:54.272339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eagle-2: Faster inference of language models with dynamic draft trees","venue":null,"work_id":"e304c83e-f884-4b66-abb2-59cf311b08f1","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:5a0f91348ac330a27a86424ed6f76ba6e966a825fdba225d70fbe513e733e88a","observation_id":"5806231e-8c2c-4088-b2f6-11c00b27ff9e","resolution":{"observed_at":"2026-05-27T09:28:54.133117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding","venue":null,"work_id":"021f42b0-4993-4ac9-abbf-13d568249cb1","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:8207f0a8a05749efc8f8eac37befb7a3ef59bdbacb756d5a3d7707517574d1ca","observation_id":"615d321e-d21c-4849-a3d1-bafd50b10521","resolution":{"observed_at":"2026-05-27T09:28:54.129079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Specexec: Massively parallel speculative decoding for interactive llm inference on consumer devices","venue":null,"work_id":"f8da91e0-2e34-4793-bb3c-4d4ac98875b7","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:2040ea73a27222fee2c643ec932ba88e690076b7a2de364b8f7c8e6a38d2521f","observation_id":"ae4474a0-e374-4643-ade2-4a24c20469e2","resolution":{"observed_at":"2026-05-27T09:28:54.275663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Break the sequential de- pendency of llm inference using lookahead decoding","venue":null,"work_id":"7911a0d3-6f48-4931-a70f-0f45b8440b32","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:a0f524e6ac17d53e95c33322c2638bc63a68306f124d670569ca8c0e74d0f38e","observation_id":"0158217d-1e6b-473b-98f7-ecee20737343","resolution":{"observed_at":"2026-05-27T09:28:54.289044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cllms: Consistency large language models","venue":null,"work_id":"ac52ccfa-272d-48f6-b07e-2981cc9f8aea","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:d84b0a2bb8f4acb41344d0c907eb730d67c2d0b56504c2bd74169be1ddcbd2cd","observation_id":"80ee3c1b-e644-4373-a042-75603652d67f","resolution":{"observed_at":"2026-05-27T09:28:54.240744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rest: Retrieval- based speculative decoding","venue":null,"work_id":"6cf75caa-96cf-448e-9a59-76ce08bc3df6","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:62b36b13d474d31bb7e953655d2c1dd72f49186af55d2138bf95f2e5da0060ef","observation_id":"413e5b16-0e87-41d2-92f0-51147bdcbebc","resolution":{"observed_at":"2026-05-27T09:28:54.258525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ouroboros: Generating longer drafts phrase by phrase for faster speculative decoding","venue":null,"work_id":"ea1aa3cd-fd22-4bfd-8f1d-fadcfa545806","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:01c0ac90ed0f6e50bff99329ee1113b9c3976963675b67ee1aca8f8913e440c0","observation_id":"1fb7d90f-2a76-444e-bc95-59cc2b53bad9","resolution":{"observed_at":"2026-05-27T09:28:54.176731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medusa: Simple llm inference acceleration framework with multiple decoding heads","venue":null,"work_id":"b12049e3-a367-4e6c-8adc-1e66e4869322","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:4a127e70ea4d98a69178be4a5eb7eadca0d09932b4f90b37e6add9d58468432b","observation_id":"73db22a3-fc50-4b9f-940f-d39fd897ef9e","resolution":{"observed_at":"2026-05-27T09:28:54.219564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hydra: Sequentially-dependent draft heads for medusa decoding","venue":null,"work_id":"e2505173-40dd-40e0-89b6-e84646349b33","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:da5d69b8ac484c70b7a640d3fe7251e91e739d5d85f90d9fa8afd4960fb9c54b","observation_id":"3cd53210-084a-42ee-a65e-938242bfa5b3","resolution":{"observed_at":"2026-05-27T09:28:54.278832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.11018","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Griffin: Effective token alignment for faster speculative decoding.arXiv preprint arXiv:2502.11018, 2025a","venue":null,"work_id":"84a70368-0274-4a8c-b0e0-7c4a323c9945","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:d960f2363adae3c14771e9b9e890c768289e685ab395cae201ecb8c71559ceae","observation_id":"8a298b37-7ab6-4baf-b354-6a9ca9f15185","resolution":{"observed_at":"2026-05-12T10:06:30.198524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15562","last_updated":"2024-08-28T06:28:01Z","snapshot_observed_at":"2026-07-06T19:06:58.753073Z","submitted_at":"2024-08-28T06:28:01Z","title":"Boosting Lossless Speculative Decoding via Feature Sampling and Partial Alignment Distillation","version":1},"cited_work":{"arxiv_id":"2408.15562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15562","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Boosting lossless speculative decoding via feature sampling and partial alignment distillation","venue":null,"work_id":"93fb034e-a4bc-4cac-8945-9999a2d13889","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2408.15562","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:bfca7f0b08e34ec19eb1538a60157bc0b1895811730fb2929d4043cddcbf084a","observation_id":"b1032ac3-1c44-4fed-8111-ba6b5f4d0ba9","resolution":{"observed_at":"2026-05-12T10:06:30.243035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16880","last_updated":"2025-05-25T14:16:22Z","snapshot_observed_at":"2026-08-03T23:38:45.873467Z","submitted_at":"2025-02-24T06:28:26Z","title":"CORAL: Learning Consistent Representations across Multi-step Training with Lighter Speculative Drafter","version":3},"cited_work":{"arxiv_id":"2502.16880","doi":"10.48550/arxiv.2502.16880","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.16880","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Coral: Learning consistent representations across multi-step training with lighter speculative drafter","venue":"ArXiv.org","work_id":"ad828ef6-c484-4710-a758-29a599cf8edc","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2502.16880","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:e596d3bd455771bb85f7b0a5568537f9c6d5b56f04ac20aedc6787a44d797cd7","observation_id":"5e5a82c0-9f92-4c46-94ec-3a2516ebc520","resolution":{"observed_at":"2026-05-12T10:06:29.865081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How speculative can speculative decoding be?","venue":null,"work_id":"87bb4230-cf94-4aa0-9984-2a530e58ea3b","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:79a5113803e5854a6100a340f13bce1e89289e68ac92fe132f1cac76b19d636c","observation_id":"b8a2e4bf-96cf-48a7-b633-5bff191870f7","resolution":{"observed_at":"2026-05-27T09:28:54.180538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.13254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Heterospec: Leveraging con- textual heterogeneity for efficient speculative decoding","venue":null,"work_id":"c8076c81-2953-4287-8ff9-cd72dbc4686d","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:4e1a3e4aaf1ffdc305fc1431624dc97d000dac17f5b0890f12b03bf7972528af","observation_id":"fd82ee0f-7577-4b08-b95d-b329e92b1c80","resolution":{"observed_at":"2026-05-12T10:06:29.886601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"a78edb88-00e3-453c-a596-7d8af8f6bd39","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:797e0a7b6549368c9a8c00ce167f912563c37268ad9a72c042cda56b74256585","observation_id":"9690de99-d5b6-44e1-9d36-6770af8ec623","resolution":{"observed_at":"2026-05-27T09:28:54.195060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A bi-step grounding paradigm for large language mod- els in recommendation systems","venue":null,"work_id":"56a38896-60c3-46a1-8253-00d8d60b0487","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:3de8591fb4b406c7b8bdebc9b295b9429992d963fb0bec05b71d92fc0af36fd1","observation_id":"8633d075-2006-4ee0-8a8e-7dbe81562684","resolution":{"observed_at":"2026-05-27T09:28:54.186470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models are learnable planners for long-term recommendation","venue":null,"work_id":"1ed64163-037e-4149-ab22-4371a02dc25a","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:7b07379a851a3ea5b04ee935379804ebd070b78f4973d9f6b42957a34925baf9","observation_id":"e6ee1658-c903-4837-a11d-d39d042f7526","resolution":{"observed_at":"2026-05-27T09:28:54.161057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:29:42.012883Z","title":"arXiv preprint arXiv:2505.19092 (2025)","venue":null,"work_id":"6fd215fb-8977-4afc-8c6c-cab80ca6b376","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:6b25d26cd64c370a08e4af76cc4dc8813bc77c5ad1a961888988a2bec9e0f40a","observation_id":"fdc0672d-d3b9-42b4-bd0a-42fec5d3b1a5","resolution":{"observed_at":"2026-05-12T10:06:30.236804Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recommender systems with generative retrieval","venue":null,"work_id":"35057ca8-558d-4aea-aaa7-4a27ab810302","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:5f2631e1ae46781c3fb12618d7cfea5449447a1eed98fecab0a2604a8f121919","observation_id":"986c789a-50c2-4e7e-b21b-4d7259389f65","resolution":{"observed_at":"2026-05-27T09:28:54.244072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13581","last_updated":"2025-08-15T23:44:20Z","snapshot_observed_at":"2026-07-06T20:39:06.470648Z","submitted_at":"2025-02-19T09:45:29Z","title":"ActionPiece: Contextually Tokenizing Action Sequences for Generative Recommendation","version":3},"cited_work":{"arxiv_id":"2502.13581","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.13581","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Actionpiece: Contextually tokeniz- ing action sequences for generative recommendation","venue":null,"work_id":"2f83d746-aace-4e7a-b113-72265531d16d","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2502.13581","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:6af05c09700f9718a152c972967836ee1e29f03d5981948f969f5d20329b8f45","observation_id":"f9af480d-8064-4dca-af9f-020a70c5992c","resolution":{"observed_at":"2026-05-12T10:06:30.248571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learnable item tokenization for generative recommendation","venue":null,"work_id":"e1b5c804-f7c8-436a-8960-949d38600e6f","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:4783d7c8167077fd535acbc331a8ca40fd7d53dc35c481c84c21c9e7e9369c7d","observation_id":"03b7c38b-faee-4235-98e1-654675ea2aab","resolution":{"observed_at":"2026-05-27T09:28:54.292050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How to index item ids for recommendation foundation models","venue":null,"work_id":"40286e1e-62d0-443e-aef6-25bf974d47d9","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:91c3ac711fe6e26caf27306540a8bc61e8048e2be03b5770a623b587a9a6dd84","observation_id":"7c322a6f-11fe-4295-a86f-00111a1d82d7","resolution":{"observed_at":"2026-05-27T09:28:54.156875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recommendation as language processing (rlp): A unified pretrain, personalized prompt & predict paradigm (p5)","venue":null,"work_id":"b5370155-5f60-4ec2-8720-eafce35be506","year":2022},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:d901d4e8b0deed207be941b3e5016b3e2f9360a503b3de14979a4cebe30a4ebe","observation_id":"53e4e53b-12f6-4c2e-b62e-3c9aefcf6478","resolution":{"observed_at":"2026-05-27T09:28:54.168794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eager: Two-stream generative recommender with behavior-semantic collaboration","venue":null,"work_id":"1e20d2bf-0d86-404d-970f-6441a6a4674c","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:c22ccc28268c2b916fa9e74707ccea62a730ed6632bdb58be3fe3fe17524240d","observation_id":"07bde36d-8eaa-48e6-b8f2-dba70125f70d","resolution":{"observed_at":"2026-05-27T09:28:54.226066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17152","last_updated":"2024-05-06T02:05:45Z","snapshot_observed_at":"2026-08-06T03:48:40.952592Z","submitted_at":"2024-02-27T02:37:37Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","version":3},"cited_work":{"arxiv_id":"2402.17152","doi":"10.48550/arxiv.2402.17152","metadata_source":"pith","pith_arxiv_id":"2402.17152","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","venue":"cs.LG","work_id":"cedb01b6-64b1-4cd7-a797-f157c3dc9930","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2402.17152","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:fdc23624cbcae6b6c76811f3db85f8a7e2e2d2b65de11e59ce6238769fc90a72","observation_id":"65fc0211-49e9-4dc6-882c-e6a46f9cceb6","resolution":{"observed_at":"2026-05-13T19:39:33.082504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-06-02T00:57:47.012388+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-02T00:57:47.012388+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sprec: Self- play to debias llm-based recommendation","venue":null,"work_id":"4f936af1-8824-46ac-bdba-dc5d940fe9a6","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:21c8b6611ba8527c29c94001e97a9465a1ad23b93707ff0be44b7e26b3fb1dcc","observation_id":"86e4deea-82f2-4278-8c42-247ec6d51a15","resolution":{"observed_at":"2026-05-27T09:28:54.183633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Process- supervised llm recommenders via flow-guided tuning","venue":null,"work_id":"11ac815b-2242-4632-b952-c9f6e105bdc2","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:3ae8725a3c962d310df4e08a3cfce552ca6a57d382d59a9de55e6bcd3d7f2c9b","observation_id":"e6205265-dad3-4e70-8255-a5af0d59e094","resolution":{"observed_at":"2026-05-27T09:28:54.247454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.02368","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:13:44.722172Z","title":"Nextquill: Causal preference modeling for enhancing llm personalization","venue":null,"work_id":"5967fec9-5e6a-42b7-b13e-8794ed8505a0","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:3158233925b1274976b1d27ab7b64edf9094b747797841cd4a3e620f0c92d717","observation_id":"5a7de5c2-3b1c-49f2-8f5c-57ede7095d87","resolution":{"observed_at":"2026-05-12T10:06:30.218617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12034","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:49:46.859939Z","title":"Don’t start over: A cost-effective framework for migrating personalized prompts between llms","venue":null,"work_id":"1e4f9cd1-bf2b-4ca3-a936-de8db35dca04","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:7600ed5d51c66c8eb8f029b0acf090ecb455c1393b632307f3b36cf5a1c05509","observation_id":"cd0301b7-eee4-4b35-82b1-244d590e497d","resolution":{"observed_at":"2026-05-12T10:06:30.224646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.06690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:19:55.980844Z","title":"Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation.arXiv preprint arXiv:2512.06690.2025","venue":null,"work_id":"e303d7f1-96bd-48e5-800b-c41246a1aaa3","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:f1099478059d76415ab3841d35bfcdd7cbb04ec034ddbe5a86d2d10d62ab1271","observation_id":"1356707f-47fe-4ec8-8235-31a7201f256e","resolution":{"observed_at":"2026-05-12T10:06:30.205546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Integrating large language models with reinforcement learning: A survey of llm-rl synergistic recommendation","venue":null,"work_id":"0e5c8aed-9853-431d-bb12-0c596da67f89","year":2026},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:58eaf4b302bdf2f6a893f46590531eede3f5fb4219fe9e6a14af802a17fe2522","observation_id":"fd4e0302-9129-4df9-a5b5-13577fa35f70","resolution":{"observed_at":"2026-05-27T09:28:54.229947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative retrieval with semantic tree-structured identifiers and contrastive learning","venue":null,"work_id":"4aaf4df6-567e-473a-9584-3e7b168c393d","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:a5a25a1d8e57daba0e5f6057a67065fbdaef2ff57171b63d11c1fb8a7a39dbe1","observation_id":"46f50316-c351-477b-b2cc-863897b32485","resolution":{"observed_at":"2026-05-27T09:28:54.140971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Idgenrec: Llm- recsys alignment with textual id learning","venue":null,"work_id":"4116a31a-48ff-4d59-8a39-6477f60012ed","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:26d49804ed69e2d336aae69e22fa985b4a09354560d53f924856819fb5c4470e","observation_id":"e20fa4b2-284a-4b30-b92b-f9ee65f9815e","resolution":{"observed_at":"2026-05-27T09:28:54.209302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wide & deep learning for recommender systems","venue":null,"work_id":"975b9270-d186-4e42-8af2-1740bf912124","year":2016},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:3ed3a702d4d53960eb718fb4b596ee0a1580bf6cfb2d5651a336f7a2516e6ff5","observation_id":"732cbecb-e851-46ef-9708-c05e12ef2e1a","resolution":{"observed_at":"2026-05-27T09:28:54.261750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lightgcn: Simplifying and powering graph convolution network for recommenda- tion","venue":null,"work_id":"4a6a81bf-12fa-409b-8a87-f16108336d05","year":2020},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:d1da7caf616c132e84d928ea53d0983c025bfd26f4447347028f6c4beb7aa556","observation_id":"7ba00ccc-2175-4a4c-ab3b-af04067d801e","resolution":{"observed_at":"2026-05-27T09:28:54.282832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T17:11:18.047486Z","title":"Second order derivatives for network pruning: Optimal brain surgeon","venue":null,"work_id":"3712653d-1ab4-4dc6-b526-614ab7cffdfb","year":1992},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:3a28464520be487bd290e63ee0181dc8157c70077c8ce2f225abc71e414cd26e","observation_id":"126bc32d-07b8-4764-8e51-69ab8293032a","resolution":{"observed_at":"2026-05-27T09:28:54.198930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07064","last_updated":"2025-07-09T17:26:10Z","snapshot_observed_at":"2026-08-06T18:45:52.406605Z","submitted_at":"2025-07-09T17:26:10Z","title":"Boosting Parameter Efficiency in LLM-Based Recommendation through Sophisticated Pruning","version":1},"cited_work":{"arxiv_id":"2507.07064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07064","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Boosting parameter efficiency in llm-based recommendation through sophisticated pruning","venue":null,"work_id":"d7af38da-87ec-459a-9566-0bcdf3313094","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2507.07064","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:bcdc902d59c27389f7fe50744369cee9f7607922fb4fc482c1b8e143a3b4fb64","observation_id":"7d303553-74b8-48d9-898f-a269db93f897","resolution":{"observed_at":"2026-05-12T10:06:30.212147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"156b4fa3-75c8-4606-acd2-73536355b560","year":2023},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:268dc6b33fa4673ec192881c55611684a2dbee3d0f278dbcf7d019cc4903a79e","observation_id":"221e6220-3a08-49ed-96ac-bc232c7c8eac","resolution":{"observed_at":"2026-05-27T09:28:54.190671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inductive generative recom- mendation via retrieval-based speculation","venue":null,"work_id":"8bd121f6-07ce-45db-9356-9d4f885d882c","year":2026},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:7efa8e3341aa518bcc7a823ae4e99f7fc357382d65acd41b69eda868112859b3","observation_id":"5d4bd148-b2a7-452b-937d-40dc05deae7b","resolution":{"observed_at":"2026-05-27T09:28:54.212673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nezha: A zero-sacrifice and hyperspeed decoding architecture for generative recommendations","venue":null,"work_id":"c6c87909-532a-4eb9-b3b2-deca07d202ad","year":2026},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:42fb59b014f623cc86488f45ec4eda7df08e92226e05b188f7ff1627330610ce","observation_id":"10456410-26dd-46ed-b2c9-15544ad62923","resolution":{"observed_at":"2026-05-27T09:28:54.233589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Earn: Efficient inference acceleration for llm-based generative recom- mendation by register tokens","venue":null,"work_id":"52152a78-999f-44b1-865f-9b50f14ec864","year":2025},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:c87ce087689cd9fdff8edaaef7f8ddf515754a7f159501824c1812a05637e2a6","observation_id":"037f22a4-d86c-4f6e-85f4-a79bebd3951e","resolution":{"observed_at":"2026-05-27T09:28:54.216140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Justifying recommendations using distantly-labeled reviews and fine-grained aspects","venue":null,"work_id":"d9a4044a-ef6f-42c9-b8bb-7fe1b1197096","year":2019},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:38b63e03dcea35373508ec354fafe48ddf7c0ef2ffdde532d7929b9d5a19a424","observation_id":"f3a0ddc1-07c3-4da0-b298-196fadc7d9d9","resolution":{"observed_at":"2026-05-27T09:28:54.265337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T07:46:57.067456Z","title":"The llama 3 herd of models","venue":null,"work_id":"87a971c0-99e0-4338-8a49-f8e7ee330f2d","year":2024},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:90c8a3eaac227da2db9d0bf7502d6fc80ad4ac7f47ac5a6c25d3f99024fd776c","observation_id":"9120ed13-f557-4aeb-b7f5-bb7d5917b393","resolution":{"observed_at":"2026-05-27T09:28:54.164808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":45},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2604.27747."}