{"as_of":"2026-08-09T02:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed5e51c10a2fa41147e48d50596fc90bf6b9f3278918b907e9bb2f0865d74e3a","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T11:34:16.795157Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29213/citation-record","integrity":"/paper/2607.29213/integrity","json":"/paper/2607.29213/citation-record.json","paper":"/paper/2607.29213"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.639019Z","title":"Deep interest evolution network for click-through rate prediction,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.639019Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:b86273b876122ceb4e24ca5aeb92124db527408d8b511f4e0414e61ec78c6130","observation_id":"94affa8c-96b6-43eb-af33-71838acee5e3","resolution":{"observed_at":"2026-08-03T11:34:16.639019Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.644268Z","title":"Click prediction learning for effective advertising,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.644268Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:d97bf0cc475bdcd03f2896ddefb5726f266a93d0a1645fa61e8c254131f1a854","observation_id":"f7f19ae6-8c72-4e0b-a285-8b42519ef4e0","resolution":{"observed_at":"2026-08-03T11:34:16.644268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09427","last_updated":"2022-09-20T02:50:46Z","snapshot_observed_at":"2026-08-08T13:19:42.050725Z","submitted_at":"2022-09-20T02:50:46Z","title":"Spatiotemporal-Enhanced Network for Click-Through Rate Prediction in Location-based Services","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.09427","snapshot_observed_at":"2026-08-03T11:34:16.648726Z","title":"Spatiotemporal-enhanced network for click-through rate prediction in location-based services,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.648726Z"},"links":{"cited_paper":"/paper/2209.09427","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:7b6e8d3f42b6a0ec31649a477a9f478061bf5a018002b4698fe23390dec00b64","observation_id":"734b256b-9d9a-40ec-9148-fc8dc97a71f6","resolution":{"observed_at":"2026-08-03T11:34:16.648726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.654004Z","title":"Cspm: A contrastive spatiotemporal preference model for ctr prediction in on-demand food delivery services,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.654004Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:26af68cd727adda1bb37ee00daae689a2ff5d24170c8fd239c7e98ad9f37af14","observation_id":"272cafaf-0ccf-4325-89aa-f6f51ce2d34a","resolution":{"observed_at":"2026-08-03T11:34:16.654004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.658318Z","title":"Pre-train and fine-tune: Recommenders as large models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.658318Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:c4b105e5e3b14f490de7d07182e46ee45cdba5dfa02639d9af3d96026a66e5ff","observation_id":"67215298-37f9-409f-a169-0e95e9f9d13a","resolution":{"observed_at":"2026-08-03T11:34:16.658318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.662871Z","title":"Multi- modality is all you need for transferable recommender systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.662871Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:9b20794c1d39f99656340d571d005bbd8073f8076025cd27b959ffdc5b8ddc4b","observation_id":"d6d7bed5-8cf3-40e7-bb47-9a6a46d78d07","resolution":{"observed_at":"2026-08-03T11:34:16.662871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06078","last_updated":"2024-04-09T07:32:55Z","snapshot_observed_at":"2026-08-01T21:24:00.779119Z","submitted_at":"2024-04-09T07:32:55Z","title":"End-to-end training of Multimodal Model and ranking Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06078","snapshot_observed_at":"2026-08-03T11:34:16.673517Z","title":"End-to-end training of multimodal model and ranking model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.673517Z"},"links":{"cited_paper":"/paper/2404.06078","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:898127e40d5a6dd9618d18e6041f941a9a33e7d8af783218b08851e0b687dda9","observation_id":"047b7ae0-5571-47f2-b9b8-16b208100b01","resolution":{"observed_at":"2026-08-03T11:34:16.673517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.678812Z","title":"Lemur: Large scale end-to-end multimodal recommendation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.678812Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:8d45082bfa5e20322c415b97d040c17a1ac95786efd19f05abdc4f043a47f8df","observation_id":"5dbe732f-9d07-42a9-a5d7-f579dbfc9ccf","resolution":{"observed_at":"2026-08-03T11:34:16.678812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.689074Z","title":"Alignrec: Aligning and training in multimodal recommendations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.689074Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:73457b4a1355575e953294528e2d3977c63f8300d9b43de45ed9984946c72985","observation_id":"ddeef56b-7895-47c8-82ea-1357dad330b7","resolution":{"observed_at":"2026-08-03T11:34:16.689074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.693879Z","title":"Enhancing taobao display advertising with multimodal representations: Challenges, approaches and insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.693879Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:3c7086ba12b460102e95b01336a9648760aeb26be6b7a47fed089f902f4d3bd2","observation_id":"614735d4-208d-4625-837c-43b56526e9f8","resolution":{"observed_at":"2026-08-03T11:34:16.693879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.699315Z","title":"Must: An effective and scalable framework for multimodal search of target modality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.699315Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:c031b00a9b21a50725ce494ea589bd572aab50a746514b3f33e14fd1e208215d","observation_id":"6cda7fc8-9299-4c9d-bbba-085ed5dad56e","resolution":{"observed_at":"2026-08-03T11:34:16.699315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.704267Z","title":"Alleviating the inconsistency of multimodal data in cross-modal retrieval,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.704267Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:9e3b6641d2f37830ded97870a80888e21e6e3e556fb66dc186e48acbe491b51b","observation_id":"55b9a5a9-932a-4c57-af45-8b6cf45a0ea2","resolution":{"observed_at":"2026-08-03T11:34:16.704267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.709583Z","title":"Neural discrete representation learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.709583Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:bee9fbdba1b3a89ec58c12f856bc9bb5d574ee0e2cd787a3a38c4747258135d0","observation_id":"f1ee5e5f-5296-42e5-8025-f40ade1b7a0a","resolution":{"observed_at":"2026-08-03T11:34:16.709583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07407","last_updated":"2022-03-23T12:06:42Z","snapshot_observed_at":"2026-07-06T10:59:51.901951Z","submitted_at":"2021-04-15T12:11:50Z","title":"MM-Rec: Multimodal News Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07407","snapshot_observed_at":"2026-08-03T11:34:16.714344Z","title":"Mm-rec: Multimodal news recommendation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.714344Z"},"links":{"cited_paper":"/paper/2104.07407","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:4c55a466bef5c48a3d980c4732d14569731573f0759bb51738930e048806b18c","observation_id":"74799350-0120-4296-9439-b8f11440b9f9","resolution":{"observed_at":"2026-08-03T11:34:16.714344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.719678Z","title":"Recommender systems with generative retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.719678Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:2dcb14ca7753d44594ba5913f8c57cfb5918b76c63165e3f1028ed07874d9f3e","observation_id":"c9a02f52-c610-4ae8-b892-5798a2a3ba0e","resolution":{"observed_at":"2026-08-03T11:34:16.719678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12740","last_updated":"2024-09-19T13:03:07Z","snapshot_observed_at":"2026-07-06T19:18:08.790424Z","submitted_at":"2024-09-19T13:03:07Z","title":"HLLM: Enhancing Sequential Recommendations via Hierarchical Large Language Models for Item and User Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12740","snapshot_observed_at":"2026-08-03T11:34:16.729423Z","title":"HLLM: enhancing sequential recommendations via hierarchical large language models for item and user modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.729423Z"},"links":{"cited_paper":"/paper/2409.12740","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:46b90bab3bfcd767a0fef135c7f5310888de81bc2ccd3c108b17b2eefbcc760c","observation_id":"a6c03b76-a475-4272-ad4a-e666e64e6dd6","resolution":{"observed_at":"2026-08-03T11:34:16.729423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.734900Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.734900Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:7d8e7592fc50fe413198c706a423f1d60e329fec7bc275995334d1ede19137aa","observation_id":"a25407e6-9ac1-44e6-98ec-515454d7967d","resolution":{"observed_at":"2026-08-03T11:34:16.734900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01335","last_updated":"2023-05-23T01:28:21Z","snapshot_observed_at":"2026-08-02T21:42:25.156081Z","submitted_at":"2022-11-02T17:47:23Z","title":"Chinese CLIP: Contrastive Vision-Language Pretraining in Chinese","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01335","snapshot_observed_at":"2026-08-03T11:34:16.740780Z","title":"Chinese CLIP: contrastive vision-language pretraining in chinese,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.740780Z"},"links":{"cited_paper":"/paper/2211.01335","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:ddc14553904a88c8bd245ed1af07373390a078494ed31ba7c3840812684b3d0c","observation_id":"01b51685-1e22-4bc2-9f44-da41d03d2333","resolution":{"observed_at":"2026-08-03T11:34:16.740780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.745956Z","title":"Align before fuse: Vision and language representation learning with momentum distillation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.745956Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:6d4a93e7900ff4f73bab4c087bf8b4f929d509916b99f03ae8e1c3e5964f43a2","observation_id":"6b1d8852-3770-4297-aca6-cfaa2c95917c","resolution":{"observed_at":"2026-08-03T11:34:16.745956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16855","last_updated":"2025-04-01T08:48:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-22T04:40:24Z","title":"GME: Improving Universal Multimodal Retrieval by Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16855","snapshot_observed_at":"2026-08-03T11:34:16.750766Z","title":"GME: improving universal multimodal retrieval by multimodal llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.750766Z"},"links":{"cited_paper":"/paper/2412.16855","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:28e84e237beef0360a2359f3ef00ce6fd6c1415a22c57beb7c3e4a9bda194fa7","observation_id":"5690c6ad-8449-4032-8c86-cf042692b700","resolution":{"observed_at":"2026-08-03T11:34:16.750766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.755991Z","title":"Unlocking scaling law in industrial recommendation systems with a three-step paradigm based large user model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.755991Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:01cd6fb25fa3d32b5d2365ed551c74bb6dc62fbcfa5c7749c7af683480f5686e","observation_id":"b0790675-a0a3-4851-8450-e0b29f058614","resolution":{"observed_at":"2026-08-03T11:34:16.755991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.761066Z","title":"Adapting large language models by integrating collaborative semantics for recommendation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.761066Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:2fa2cba5a1ed7b9c336e141832005a6d9d37a7978aa76284b31aba219ceda70d","observation_id":"3a380cd1-e765-48a1-9a65-78db2f6cda10","resolution":{"observed_at":"2026-08-03T11:34:16.761066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.765873Z","title":"Momentum contrast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.765873Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:6e308d3c9324a408f238ae48459b08a713023467cb8b4d1f6800443cf12a8e32","observation_id":"a3ecaf8f-b82d-4a13-a9c1-2222202cf876","resolution":{"observed_at":"2026-08-03T11:34:16.765873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-03T11:34:16.770895Z","title":"Representation learning with contrastive predictive coding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.770895Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:3e7886615b7a67a81533354d82746543c40d2c95ef8e427ba5fbb0abe99c3ced","observation_id":"5e336b12-4ff5-4b36-bf07-57f14c6f7d89","resolution":{"observed_at":"2026-08-03T11:34:16.770895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.775845Z","title":"Notellm-2: Multimodal large representation models for recommendation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.775845Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:d76213fe9b138ac1c8f10cc28f7504b2eb6ef85d88f941cd2dc7f6284cf29292","observation_id":"5cb5713d-fd39-496b-8111-777fab0d58b8","resolution":{"observed_at":"2026-08-03T11:34:16.775845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.785617Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.785617Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:70be22f63019627f817be9d7673415beade131dcbf343c8f5bca39be0b8a01db","observation_id":"03c4c893-39aa-4db9-b822-d9c7636d45f0","resolution":{"observed_at":"2026-08-03T11:34:16.785617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.790321Z","title":"The use of the area under the ROC curve in the evaluation of machine learning algorithms,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.790321Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:2b20802d692a88eff7a13b4b71cfcb2974fa69a09a8b73774730b949456ea0d4","observation_id":"8aecb682-21c4-4c37-af86-18979c31b752","resolution":{"observed_at":"2026-08-03T11:34:16.790321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.795157Z","title":"Practical lessons from predicting clicks on ads at facebook,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.795157Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:6ff855710278cd1574b06dc30f67ce9cc4148305b3e6652e0987e7eae985043b","observation_id":"5f6c3df6-0a20-4043-bb41-1eba1347af09","resolution":{"observed_at":"2026-08-03T11:34:16.795157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.724526Z","title":"Available: http://papers.nips.cc/paper\\ files/paper/202 3/hash/20dcab0f14046a5c6b02b61da9f13229-Abstract-Conference.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.724526Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:cf1bfefba47c954cef1e1670a529a16d0ff95149796b363589f972c05c84d955","observation_id":"2eac5d19-8741-452d-aea7-82fa37d36715","resolution":{"observed_at":"2026-08-03T11:34:16.724526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.683911Z","title":"Available: https://arxiv.org/abs/2511.10962","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.683911Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:7eb7a463b1e6fb4eb6628341c0a474e6e1c750e787527199f5254e694bf2e3dc","observation_id":"ef1b0572-9e64-44cd-aec9-e7233e16f5db","resolution":{"observed_at":"2026-08-03T11:34:16.683911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:34:16.780873Z","title":"Available: https://doi.org/10.1145/3690624.3709440","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System","version":1},"reference_index":2826,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:16.780873Z"},"links":{"citing_paper":"/paper/2607.29213"},"observation_digest":"sha256:aaae83d47af116760a04ef975a0cb2342b426cea5e9c3e0a0450c7aa12d93256","observation_id":"07dda1e1-3add-4680-ac08-946a3bf2db9b","resolution":{"observed_at":"2026-08-03T11:34:16.780873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29213","last_updated":"2026-07-31T09:32:01Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-08T08:57:34.690780Z","submitted_at":"2026-07-31T09:32:01Z","title":"GALA: Generative Aligned Learning for Adaptive Multimodal Representation in the Taobao Shangou Recommender System"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2607.29213."}