{"as_of":"2026-08-06T19:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73a70870a17ddbf94a12b7e1a1b25394e6697b7a1e03ad5aa9f865e7d03f7430","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:54:18.900221Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T17:44:18.414311Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"cited_work":{"arxiv_id":"2512.11529","doi":"10.48550/arxiv.2512.11529","metadata_source":"arxiv_reference","pith_arxiv_id":"2512.11529","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"xgr: Efficient generative recommendation serving at scale","venue":"arXiv (Cornell University)","work_id":"83e01149-10a1-497d-b993-7b58b366cc76","year":2025},"citing_paper":{"arxiv_id":"2605.04450","last_updated":"2026-05-06T03:25:22Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:25:22Z","title":"One Pool, Two Caches: Adaptive HBM Partitioning for Accelerating Generative Recommender Serving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T17:44:18.414311Z"},"links":{"cited_paper":"/paper/2512.11529","citing_paper":"/paper/2605.04450"},"observation_digest":"sha256:26b4c60b120faa6f41fc1d792753ac5b720a284e109409495e3aa993100f56df","observation_id":"f43820cd-7a48-491e-b9ca-98325f5815bd","resolution":{"observed_at":"2026-06-30T02:15:36.626357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.11529/citation-record","integrity":"/paper/2512.11529/integrity","json":"/paper/2512.11529/citation-record.json","paper":"/paper/2512.11529"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-03T16:54:14.776018Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:14.776018Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:c64e77d1b573e7f066aa90c9b78cb531fa019bc5770a8608c5050dbd63a71827","observation_id":"c366178b-b35b-4ce5-a7cf-4afa4750c38e","resolution":{"observed_at":"2026-08-03T16:54:14.776018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:14.839017Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:14.839017Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:b3a73006e6da6ff2f1663a5c13ae412898df010f36d4a7954a2f8f1396f7912b","observation_id":"c569f7e9-ad95-4fc7-aa5f-a9aa5700409b","resolution":{"observed_at":"2026-08-03T16:54:14.839017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:14.909196Z","title":"Wide & deep learning for recommender systems","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:14.909196Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:9dbd6969eed593f679b59d70579963f12be2bc388414bb06cf34409a84f40795","observation_id":"05cd57a5-f725-4ee2-bcdc-00049b6d75eb","resolution":{"observed_at":"2026-08-03T16:54:14.909196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:14.980894Z","title":"Deep neural networks for youtube recommendations","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:14.980894Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:edd5929fa6b20a5b6a454c3136ead8b782b9b083667a0e735ed28f31b63d8672","observation_id":"86c6b380-53a7-4216-931b-c4808d9f5e6b","resolution":{"observed_at":"2026-08-03T16:54:14.980894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:15.078468Z","title":"Flashattention: Fast and memory- efficient exact attention with io-awareness.Advances in neural information processing systems, 35:16344– 16359, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.078468Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:78b1d145a49e63326f56d6cce4ed219a39c4d6ca790c7d00b978ab8d21937316","observation_id":"9d97c9a0-3ba3-4a90-a6a9-a62e942e2135","resolution":{"observed_at":"2026-08-03T16:54:15.078468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:15.148909Z","title":"A review of modern recommender systems using generative models (gen-recsys)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.148909Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:006d05a1a7ef72633b268bd8e0852b3fd0705d435507fd86f66e908b90acbdaa","observation_id":"4cf09f93-ff46-4dd7-828b-e7947afea323","resolution":{"observed_at":"2026-08-03T16:54:15.148909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18965","last_updated":"2025-02-26T09:25:10Z","snapshot_observed_at":"2026-07-06T20:42:55.911327Z","submitted_at":"2025-02-26T09:25:10Z","title":"OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18965","snapshot_observed_at":"2026-08-03T16:54:15.211745Z","title":"Onerec: Unifying retrieve and rank with generative rec- ommender and iterative preference alignment.arXiv preprint arXiv:2502.18965, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.211745Z"},"links":{"cited_paper":"/paper/2502.18965","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:3675c60f5b3f238cfa9f7ed78bb30568ac02bfd37594af898ef506cfb38cd7af","observation_id":"1bdcf63e-eaa2-47b0-a7aa-da762e15418a","resolution":{"observed_at":"2026-08-03T16:54:15.211745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15100","last_updated":"2025-05-12T08:20:08Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:01:37Z","title":"XGrammar: Flexible and Efficient Structured Generation Engine for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15100","snapshot_observed_at":"2026-08-03T16:54:15.310376Z","title":"Xgram- mar: Flexible and efficient structured generation en- gine for large language models.arXiv preprint arXiv:2411.15100, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.310376Z"},"links":{"cited_paper":"/paper/2411.15100","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:0d26f257a481f20e10703a1dc7f03edcdb1a77e9e4dfe516b2ee30ac5aefa70c","observation_id":"ce57243c-bb87-4c24-854b-d477197764c3","resolution":{"observed_at":"2026-08-03T16:54:15.310376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:15.409728Z","title":"Prefillonly: An infer- ence engine for prefill-only workloads in large language model applications","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.409728Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:0784e47465aa076d062e415e5459a7593abc6d57db4e0a6e9bb8a87119cd85e7","observation_id":"1cfd4f00-d144-459c-87ee-d9b3ea01dae2","resolution":{"observed_at":"2026-08-03T16:54:15.409728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:15.508752Z","title":"Recommendation systems: Algorithms, challenges, metrics, and business opportunities.applied sciences, 10(21):7748, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.508752Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:97669cadebfe9b8964802ebee1785d6e7c9352afbb85033d35e3041e82691938","observation_id":"db1feced-e85e-43fb-bc59-9a62447306b3","resolution":{"observed_at":"2026-08-03T16:54:15.508752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:15.629679Z","title":"Self-supervised learning on users’ spontaneous behaviors for multi-scenario ranking in e- commerce","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.629679Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:14584b2ac2b629734cb44553358cfc137a110b2c78f6a4ba13453844df4ab862","observation_id":"f5d64881-617f-495d-8d35-61492a106d85","resolution":{"observed_at":"2026-08-03T16:54:15.629679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:15.810865Z","title":"Gmlake: Efficient and transparent gpu memory defragmentation for large-scale dnn train- ing with virtual memory stitching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.810865Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:d3ec09803d4cf83f14c3b52f62127947993aded81dbc20f6a94dec38828228ce","observation_id":"7b41b132-e123-425e-b046-627786003571","resolution":{"observed_at":"2026-08-03T16:54:15.810865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04247","last_updated":"2017-03-13T04:55:19Z","snapshot_observed_at":"2026-07-06T05:33:25.278531Z","submitted_at":"2017-03-13T04:55:19Z","title":"DeepFM: A Factorization-Machine based Neural Network for CTR Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04247","snapshot_observed_at":"2026-08-03T16:54:15.997576Z","title":"Deepfm: a factorization-machine based neural network for ctr prediction.arXiv preprint arXiv:1703.04247, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:15.997576Z"},"links":{"cited_paper":"/paper/1703.04247","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:6426c175421bfdf8389ba3ed4eb7d1e9a9348cbb5e142bb7bc20d07d1b34e393","observation_id":"aedf5704-43d9-4f40-8954-2927f9bfa854","resolution":{"observed_at":"2026-08-03T16:54:15.997576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.137340Z","title":"Mtgr: Industrial-scale generative recommendation framework in meituan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.137340Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:1764d238c36d18db9aa0913ecbb131980c4cfe28cf64a5d7f7b6bfb667e81f35","observation_id":"e5100d6f-9361-431e-b67e-eff45861ee3a","resolution":{"observed_at":"2026-08-03T16:54:16.137340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03952","last_updated":"2026-04-20T06:05:54Z","snapshot_observed_at":"2026-08-03T00:56:47.399756Z","submitted_at":"2024-03-06T18:56:36Z","title":"Bridging Language and Items for Retrieval and Recommendation: Benchmarking LLMs as Semantic Encoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03952","snapshot_observed_at":"2026-08-03T16:54:16.289586Z","title":"Bridging language and items for retrieval and recommendation.arXiv preprint arXiv:2403.03952, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.289586Z"},"links":{"cited_paper":"/paper/2403.03952","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:e6b7a5f745081a13be4a362d0b138de11e1dc808907ae9e04d68a3ca9734d51e","observation_id":"76b90a34-98da-44cf-b599-5d1daa47efad","resolution":{"observed_at":"2026-08-03T16:54:16.289586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.380473Z","title":"Picture recommen- dation system built on instagram","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.380473Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:5834cf28fa4a190627a5e8e1a7b839188542bb5c77b2875b37016143239083e3","observation_id":"ceaef617-cd0a-41b5-b83b-2e0b6b0592d6","resolution":{"observed_at":"2026-08-03T16:54:16.380473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.460147Z","title":"Revisiting recom- mender systems: an investigative survey.Neural Com- puting and Applications, 37(4):2145–2173, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.460147Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:4f897cc53f42ecb07b619e8dab97fd307d6de61e588b4cbb0ba2e73c13da0609","observation_id":"41be2315-1fa9-4fb4-b7b0-f850dbb928f2","resolution":{"observed_at":"2026-08-03T16:54:16.460147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-03T16:54:16.552005Z","title":"Scal- ing laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.552005Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:4ab86c8e6622d3f0612461deaa2a1342cd1b9cac27f11b653e448a7f1ef9c694","observation_id":"3fcb98e7-db31-48b2-803a-3e857f96968c","resolution":{"observed_at":"2026-08-03T16:54:16.552005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.630371Z","title":"Hercules: Heterogeneity-aware inference serving for at-scale per- sonalized recommendation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.630371Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:45182e380d51023ef3ea37d273d167b68ef4b8debf59f81346d0bcd17f158c57","observation_id":"4003f067-0f37-40fd-a33d-d5089744ef12","resolution":{"observed_at":"2026-08-03T16:54:16.630371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.688644Z","title":"A survey of recommendation systems: recom- mendation models, techniques, and application fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.688644Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:2a8810bfb68e7a975f4ee4e3e6e42e06403cab4f0ad2d6520f70bc5af1b2a50d","observation_id":"a015bb3c-6958-4996-a6be-9a17334e459c","resolution":{"observed_at":"2026-08-03T16:54:16.688644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.776082Z","title":"Minionerec: An open-source framework for scaling generative recommendation.arXiv preprint arXiv:2510.24431, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.776082Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:dbbd50057cc673bd0a7d1cd97dd4959e061e7e6d8409a4a5ae44368c8c8772cf","observation_id":"3d76fa29-0808-415c-8c21-add7e0f4c757","resolution":{"observed_at":"2026-08-03T16:54:16.776082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.841929Z","title":"Efficient memory manage- ment for large language model serving with pagedatten- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.841929Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:48c27dc71a3dd59c7633e3fd79ef4c758cb0db74dc875aeac7aaad0b9cbefde2","observation_id":"e383b867-2ab9-4ba6-b7f1-9e5f6effc899","resolution":{"observed_at":"2026-08-03T16:54:16.841929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:16.943225Z","title":"Machine translation decoding beyond beam search","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:16.943225Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:147d037f0598832fa9ca6f2424ce365407cc32c4b9497277f1a0bd472eada525","observation_id":"cb9b6ace-37aa-4769-b9c7-ab3ae6bb14e3","resolution":{"observed_at":"2026-08-03T16:54:16.943225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.014368Z","title":"How can recommender systems benefit from large language models: A survey.ACM Transactions on Information Systems, 43(2):1–47, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.014368Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:e9d60e20ad86e4976381f3d9b5592d8f655ece6fca1d409fff6dc92d90a31cfc","observation_id":"aa61a01d-5197-461a-9a8f-178883f40c02","resolution":{"observed_at":"2026-08-03T16:54:17.014368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05165","last_updated":"2025-02-26T05:30:36Z","snapshot_observed_at":"2026-08-02T03:57:54.683008Z","submitted_at":"2024-10-07T16:23:36Z","title":"Efficient Inference for Large Language Model-based Generative Recommendation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05165","snapshot_observed_at":"2026-08-03T16:54:17.103527Z","title":"Efficient inference for large language model- based generative recommendation.arXiv preprint arXiv:2410.05165, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.103527Z"},"links":{"cited_paper":"/paper/2410.05165","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:056537a88c0b22a577203e9d1e39fbdd70b244e457e185bb87ae35f88760ffed","observation_id":"25ffa2a8-2788-406d-a5bf-81ef8e2e62b9","resolution":{"observed_at":"2026-08-03T16:54:17.103527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-03T16:54:17.189844Z","title":"Deepseek-v3 techni- cal report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.189844Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:f2deef41f4c4badfec9c24347fe9dfb58d3c443631d666319f9dd90514f83732","observation_id":"9b35df06-b711-4ec8-99ed-44f06639e7ef","resolution":{"observed_at":"2026-08-03T16:54:17.189844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.290866Z","title":"xllm technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.290866Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:a4d87b04ee6fc0798974b21ad374b30efcb0e5964c6a532f61e9fb77cb5d0f4a","observation_id":"930e4476-837b-4159-a92e-3779fc6ac012","resolution":{"observed_at":"2026-08-03T16:54:17.290866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07663","last_updated":"2022-09-27T21:58:20Z","snapshot_observed_at":"2026-08-04T08:04:12.757450Z","submitted_at":"2022-09-16T00:58:16Z","title":"Monolith: Real Time Recommendation System With Collisionless Embedding Table","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07663","snapshot_observed_at":"2026-08-03T16:54:17.370060Z","title":"Monolith: real time recommenda- tion system with collisionless embedding table.arXiv preprint arXiv:2209.07663, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.370060Z"},"links":{"cited_paper":"/paper/2209.07663","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:f3fa6ce82cd31e13636802a61a015f6826aaeb2f951e89a5e586fe5f5adf9548","observation_id":"e3accc95-0d03-4016-b8a0-d9bc660d249d","resolution":{"observed_at":"2026-08-03T16:54:17.370060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.433614Z","title":"If beam search is the answer, what was the question? InPro- ceedings of the 2020 conference on empirical methods in natural language processing (emnlp), pages 2173–2185, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.433614Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:b1009a60fb3fc5eb2baeceb3fe4c8ffa0c2b16640600a6b121b2ac85b5452d3d","observation_id":"825e3802-7d17-4154-a16b-e47a41cf5432","resolution":{"observed_at":"2026-08-03T16:54:17.433614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.00091","last_updated":"2019-05-31T21:51:16Z","snapshot_observed_at":"2026-08-02T13:53:54.252223Z","submitted_at":"2019-05-31T21:51:16Z","title":"Deep Learning Recommendation Model for Personalization and Recommendation Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.00091","snapshot_observed_at":"2026-08-03T16:54:17.529002Z","title":"Deep learning recommen- dation model for personalization and recommendation systems.arXiv preprint arXiv:1906.00091, 2019","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.529002Z"},"links":{"cited_paper":"/paper/1906.00091","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:304bc69a9a63b2703e7eaf04aa7f19770f799ee8f7d057b05c8bd40627499a3e","observation_id":"b25e41de-a802-4de9-aa35-38c01d869507","resolution":{"observed_at":"2026-08-03T16:54:17.529002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.592116Z","title":"Splitwise: Efficient generative llm inference using phase splitting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.592116Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:266e53ba901399223f6bbada9caf6b44d858adce61c9507933db64af153a59db","observation_id":"ac4b3113-9000-4c6f-9cb6-c6c9f73bb853","resolution":{"observed_at":"2026-08-03T16:54:17.592116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.644324Z","title":"Recommender systems with generative retrieval.Ad- vances in Neural Information Processing Systems, 36:10299–10315, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.644324Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:13b75516861574222f9010f97de99ca8015869cad926b72bc9fff149a808bd34","observation_id":"66887b3d-1aa1-49e5-bf97-6e1673ffdc96","resolution":{"observed_at":"2026-08-03T16:54:17.644324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04093","last_updated":"2025-02-09T16:06:53Z","snapshot_observed_at":"2026-07-06T18:58:09.650413Z","submitted_at":"2024-08-07T21:16:55Z","title":"Tree Attention: Topology-aware Decoding for Long-Context Attention on GPU clusters","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04093","snapshot_observed_at":"2026-08-03T16:54:17.726744Z","title":"Tree attention: Topology-aware decoding for long-context attention on gpu clusters.arXiv preprint arXiv:2408.04093, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.726744Z"},"links":{"cited_paper":"/paper/2408.04093","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:45e37b8080cd52995862b846893d4808192e45685ad01e107efd2feb0bcef827","observation_id":"4e204637-329e-483b-a9c9-18511a458a6a","resolution":{"observed_at":"2026-08-03T16:54:17.726744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.806626Z","title":"Ekko: A {Large- Scale} deep learning recommender system with {Low- Latency} model update","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.806626Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:3282f65a1a70c315f8088725ee7e3276b92715438280d51e7d39f77eb363de02","observation_id":"a2160b19-edd5-4b0a-be71-20032e0e7ac0","resolution":{"observed_at":"2026-08-03T16:54:17.806626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.862264Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.862264Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:3199bdfefed81db66ac503210fab18e7cc86ed4af286f35785723bac5176b704","observation_id":"9d5c2b88-a4ab-45c3-bb09-23d960752ba2","resolution":{"observed_at":"2026-08-03T16:54:17.862264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.916072Z","title":"Scaling transformers for discriminative recommendation via generative pre- training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.916072Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:5ec5b8609b922ead1bb6c6afbfb4ec6b3fe8dd760a09462cd65b0be3bb988a01","observation_id":"fa3fe061-ac8f-4b5e-9ee2-d57c088d1973","resolution":{"observed_at":"2026-08-03T16:54:17.916072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:17.997774Z","title":"Atrec: Accelerating recommendation model train- ing on cpus.IEEE Transactions on Parallel and Dis- tributed Systems, 35(6):905–918, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:17.997774Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:f7b858d8853d791421001ff78ac93bf64d4263a10b8464c0f6a5b827905dba62","observation_id":"8b3141dd-07ee-4828-81af-547fc067a854","resolution":{"observed_at":"2026-08-03T16:54:17.997774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.050114Z","title":"A gpu-specialized inference parameter server for large-scale deep recom- mendation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.050114Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:88da02c90304bee45415151b35a432cdc1ff93f5cfcab7dbd42ac953e50e9578","observation_id":"ff5b75de-3aa1-4e58-86af-a707466f9035","resolution":{"observed_at":"2026-08-03T16:54:18.050114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.103580Z","title":"Self- evaluation guided beam search for reasoning.Advances in Neural Information Processing Systems, 36:41618– 41650, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.103580Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:b656e23825856bd438ebe00d11edc854ef208993f678ef8e975aca0afe83dce2","observation_id":"7317d57b-b4ff-445b-8cd8-03d3f9f4fba4","resolution":{"observed_at":"2026-08-03T16:54:18.103580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T16:54:18.150937Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.150937Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:a5f4bcc725044b1c7a875e710e7c5e72b714ea7193b19481f25b9c0a9d93b709","observation_id":"782fb9b5-1823-43dd-a745-2f93667fd7cb","resolution":{"observed_at":"2026-08-03T16:54:18.150937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.202769Z","title":"{GPU-Disaggregated} serving for deep learning recommendation models at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.202769Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:11a920fdfed2687d8267236a7ac3f2a3ef6d985d706f5810fd25476a34aed79f","observation_id":"04277e4a-992d-48c9-8777-23a0899fd1d1","resolution":{"observed_at":"2026-08-03T16:54:18.202769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.254193Z","title":"Cacheblend: Fast large language model serving for rag with cached knowledge fusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.254193Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:d68637fe37688252a0eb58b4953725b22a7506a27658a5944e12537eed016378","observation_id":"b4f4356c-7a93-47f5-8b92-2a9c662f6f32","resolution":{"observed_at":"2026-08-03T16:54:18.254193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.302107Z","title":"Grace: A scalable graph-based approach to accelerating recommendation model inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.302107Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:b7fc503fb8edae54eb24ddffe753cb7278fc4a0e7b29120906f113e2ee5ac74d","observation_id":"3e6c739b-de72-4f05-a3ff-717a57534e1e","resolution":{"observed_at":"2026-08-03T16:54:18.302107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.360945Z","title":"Orca: A distributed serving system for {Transformer-Based} generative models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.360945Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:3cd3ea917dc62a1f953bc54d87d9cba4e2c687430dbf450164c4416c4c77aeb3","observation_id":"88fe549c-fff7-412c-8f29-23602b0f4b81","resolution":{"observed_at":"2026-08-03T16:54:18.360945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.427480Z","title":"Ic-cache: Efficient large language model serving via in-context caching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.427480Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:148508355b341aa5555ab1f3192a2bac3ced6a06357fe201a8a7a6b24dda4772","observation_id":"fdf66428-9652-4e48-872c-d08f7750e71c","resolution":{"observed_at":"2026-08-03T16:54:18.427480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.502942Z","title":"Evaluating recom- mender systems: survey and framework.ACM comput- ing surveys, 55(8):1–38, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.502942Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:746751fa81c6c196cec4cb02cb26f0ae38ba27aedccc9c4220edb130f82eb52b","observation_id":"d6616cb3-276b-4919-8751-a4ea021c2ff4","resolution":{"observed_at":"2026-08-03T16:54:18.502942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17152","last_updated":"2024-05-06T02:05:45Z","snapshot_observed_at":"2026-08-06T03:48:40.952592Z","submitted_at":"2024-02-27T02:37:37Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17152","snapshot_observed_at":"2026-08-03T16:54:18.584806Z","title":"Actions speak louder than words: Trillion-parameter sequential transducers for generative recommendations.arXiv preprint arXiv:2402.17152, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.584806Z"},"links":{"cited_paper":"/paper/2402.17152","citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:ebd7ee16101e71f5cf112184d566366dd7482a0693f039dda4c9da9a544d1f41","observation_id":"5ede7056-9c76-4231-a11c-69d3855402e9","resolution":{"observed_at":"2026-08-03T16:54:18.584806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.667075Z","title":"Diffkv: Differentiated memory man- agement for large language models with parallel kv com- paction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.667075Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:ab655feb23763a1b5893fbb63e227ef85a93604a29adda8a8c4472c260405eec","observation_id":"a70c72ec-6bc7-456f-8837-c6501e096d51","resolution":{"observed_at":"2026-08-03T16:54:18.667075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.742390Z","title":"Sglang: Efficient execution of structured language model programs.Advances in neural information pro- cessing systems, 37:62557–62583, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.742390Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:e365a961e1943df8cf69e2ab5b4c6fde3810357111600b902cdc855c78fc8223","observation_id":"844255f3-a2c8-4300-8d72-ef17d98288d6","resolution":{"observed_at":"2026-08-03T16:54:18.742390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.800449Z","title":"{DistServe}: Disaggregating prefill and decoding for goodput-optimized large language model serving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.800449Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:f8dfdbf90d014c901c803b9d73d1d88a019b9cadd12488be9629626eeef7496f","observation_id":"b0e0300d-d120-4c8a-be6f-335d403cb4f1","resolution":{"observed_at":"2026-08-03T16:54:18.800449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.855454Z","title":"{NanoFlow}: Towards opti- mal large language model serving throughput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.855454Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:d527c7862cba1d16addd336a7fa704a2e5ca09b520118dc5e74adabc716ab15d","observation_id":"a48897a5-c25b-4940-8769-ac154fd2049e","resolution":{"observed_at":"2026-08-03T16:54:18.855454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:54:18.900221Z","title":"Relayattention for efficient large language model serving with long system prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T16:54:18.900221Z"},"links":{"citing_paper":"/paper/2512.11529"},"observation_digest":"sha256:d7ce4ae797dedd86f0244352cdb95abbbed95a6e7c1a4305663f64cb0860aae1","observation_id":"1639c36f-62e9-450d-8f75-bd4dbc650227","resolution":{"observed_at":"2026-08-03T16:54:18.900221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.11529","last_updated":"2026-06-27T09:37:56Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T16:54:13.357239Z","submitted_at":"2025-12-12T12:59:38Z","title":"xGR: Efficient Generative Recommendation Serving at Scale"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2512.11529."}