{"as_of":"2026-08-21T08:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10b029243fcb5786e8d19fb1b95e65392087be0a8d393b1d226c0c8c77f46553","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:48:36.434783Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20655/citation-record","integrity":"/paper/2607.20655/integrity","json":"/paper/2607.20655/citation-record.json","paper":"/paper/2607.20655"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:30.700160Z","title":"Learning to rank using gradient descent","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:30.700160Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:2049ca8ea13dc10b83c07cd6a4a46dae7b227daf3cee027e3546c85b9ab22401","observation_id":"48e22c3b-88b7-415b-87a2-65b89380e361","resolution":{"observed_at":"2026-08-01T09:48:30.700160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:30.804690Z","title":"Learning to rank: from pairwise approach to listwise approach","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:30.804690Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:a5ab2d97f22dbb5da724817b9dd1522e105e6e103a780e6d00e7eea22735adf0","observation_id":"22b60f98-a311-41e3-b12a-8f2814980f0a","resolution":{"observed_at":"2026-08-01T09:48:30.804690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:30.958952Z","title":"Top-k off-policy correction for a reinforce recommender sys- tem","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:30.958952Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:59e9360c2cf6f91fa3823e4acc654b4ccfaa4dfa3b74b46da1fb329e91f63fd6","observation_id":"a601e68c-ccea-4534-8db2-4ba3b416b8e5","resolution":{"observed_at":"2026-08-01T09:48:30.958952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:31.143118Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:31.143118Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:d2fb42a002ba5cebf592174105e0867e8570e07bcf333c79b23250cd61379ae5","observation_id":"c1ab11a5-c981-4c77-9a0d-ab58ea665478","resolution":{"observed_at":"2026-08-01T09:48:31.143118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:31.310947Z","title":"Wide & deep learning for recom- mender systems","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:31.310947Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:a5b92100e98150b07fbd16265ddf0d8a0e79a58a767839292d1ff8c665f0aaf3","observation_id":"7da18a45-5d86-48d1-8ebc-f25bb407024d","resolution":{"observed_at":"2026-08-01T09:48:31.310947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:31.449498Z","title":"Click models for web search","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:31.449498Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:9cba3252515dc8460323b94d318c9a55ab111ffd80979ec15df74b6123f4a84c","observation_id":"a046b104-9829-421d-aeee-3c0cf0da5f45","resolution":{"observed_at":"2026-08-01T09:48:31.449498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:31.575482Z","title":"A survey on con- cept drift adaptation.ACM Computing Surveys, 46(4):1– 37, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:31.575482Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:ef1621f2826f7ff7792ef578002fb215bde6188aeaf589aa5cacab254ea465ff","observation_id":"21991da6-f91d-4edc-b360-3e0dbb41e9cd","resolution":{"observed_at":"2026-08-01T09:48:31.575482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:31.727532Z","title":"Deepfm: a factorization-machine based neural network for ctr prediction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:31.727532Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:2d83f06e00413396ee326e7979061a4797118c4cdd9a86a16ae42bc4a8abde6a","observation_id":"35032c99-fcdf-4644-89d9-98b540175655","resolution":{"observed_at":"2026-08-01T09:48:31.727532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:31.932847Z","title":"Lora: Low-rank adaptation of large language mod- els","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:31.932847Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:37c3fdc66a0e605882b5b8c2a1c629e07153e6ee0584d61c2f95547e117bd169","observation_id":"aa53d8a5-1bf7-4572-9563-a86101ee533b","resolution":{"observed_at":"2026-08-01T09:48:31.932847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02305","last_updated":"2025-02-16T17:16:38Z","snapshot_observed_at":"2026-08-18T15:15:40.856559Z","submitted_at":"2024-11-04T17:30:51Z","title":"CRMArena: Understanding the Capacity of LLM Agents to Perform Professional CRM Tasks in Realistic Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02305","snapshot_observed_at":"2026-08-01T09:48:32.095788Z","title":"Crmarena: Understand- ing the capacity of llm agents to perform professional crm tasks in realistic environments.arXiv preprint arXiv:2411.02305, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:32.095788Z"},"links":{"cited_paper":"/paper/2411.02305","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:456322b723f520aa9c11466cf0fe1a90b4c3da73ee89b9cb5597bd1a56a23b5a","observation_id":"0ece80c5-09ca-4163-b44a-68a3d6ff0694","resolution":{"observed_at":"2026-08-01T09:48:32.095788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:32.268229Z","title":"Slateq: A tractable decomposition for reinforcement learning with recommendation sets","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:32.268229Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:56014b58ea67fb7281994df44b88dc39c4b2a7e9da9416c4d2644c6c22c5e784","observation_id":"7eb912f6-75cc-4972-b7a8-f93d65cfba46","resolution":{"observed_at":"2026-08-01T09:48:32.268229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:32.410159Z","title":"To model or to intervene: A comparison of counterfac- tual and online learning to rank from user interactions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:32.410159Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:99392c39d1090560ffd170d47fd84e17ccbf1b2134d2b0db03692dab027d3cea","observation_id":"d4ec2dd6-f4ae-4d88-a43b-ee2ec898434e","resolution":{"observed_at":"2026-08-01T09:48:32.410159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:32.532511Z","title":"Improving generative ad text on facebook using reinforcement learning.arXiv preprint arXiv:2507.21983, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:32.532511Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:e200662aa3a5416e2d577f2c728894e72b6cf72559f0d2a33a48564a75d51ce2","observation_id":"8f353fa6-41d5-425e-aded-712dcd7691bc","resolution":{"observed_at":"2026-08-01T09:48:32.532511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:32.677039Z","title":"xdeepfm: Combining explicit and implicit feature interactions for recommender systems","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:32.677039Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:9585ce25b3a0e2e1ae0300bdf81836855f48787bbf9c97a0e73c78981f5c0253","observation_id":"a3344d1d-5ac9-4877-b18f-bd9182f1af95","resolution":{"observed_at":"2026-08-01T09:48:32.677039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:32.869166Z","title":"Springer, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:32.869166Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:e12896cfe3402632d3b6ed33c77f6a08b0332b5f70b5e3aa5bb56aca3a83ccf2","observation_id":"a8a48691-7f32-4587-b0fb-9a629289e189","resolution":{"observed_at":"2026-08-01T09:48:32.869166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:33.004316Z","title":"Decoupled weight de- cay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.004316Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:f57a5982b3ad836f5b470c8fe88002a39ffc2d954a3353199ad125b2e4bb7826","observation_id":"bfc6e491-cfa8-4baf-91fd-8035ea9fa241","resolution":{"observed_at":"2026-08-01T09:48:33.004316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23303","last_updated":"2025-03-30T03:56:26Z","snapshot_observed_at":"2026-08-16T12:45:39.588245Z","submitted_at":"2025-03-30T03:56:26Z","title":"SalesRLAgent: A Reinforcement Learning Approach for Real-Time Sales Conversion Prediction and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23303","snapshot_observed_at":"2026-08-01T09:48:33.136336Z","title":"Salesrlagent: A re- inforcement learning approach for real-time sales con- version prediction and optimization.arXiv preprint arXiv:2503.23303, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.136336Z"},"links":{"cited_paper":"/paper/2503.23303","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:a05c761402c49ee41cb4f4da5d723f95ed80fb62a62c2076942d1ea86ee8e327","observation_id":"7579fc92-fabb-4086-be03-bdab0cae0b1b","resolution":{"observed_at":"2026-08-01T09:48:33.136336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:33.317651Z","title":"Differentiable unbiased online learning to rank","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.317651Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:d75bd10d63470477cb1f32ae29238beebffae0e1ff97c7f042945ecb00206c81","observation_id":"0ed364cf-34ad-4b3f-bbfd-f4131f2eee29","resolution":{"observed_at":"2026-08-01T09:48:33.317651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:33.470125Z","title":"Training lan- guage models to follow instructions with human feed- back.Advances in Neural Information Processing Sys- tems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.470125Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:523248c0ed9f15aa9b44e330d9592a6437837869f6fe4b0e879fb7abda47798e","observation_id":"9173f181-ffc8-46e5-9b1f-68a687d0b5d8","resolution":{"observed_at":"2026-08-01T09:48:33.470125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:33.621148Z","title":"Continual lifelong learning with neural networks: A review.Neural Net- works, 113:54–71, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.621148Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:4da93d858979859651bc861d0d804d335e3670f904e9036f705e182da31c732b","observation_id":"6bc00d1a-a85f-4ccf-a4e0-4fd0b4f4da6d","resolution":{"observed_at":"2026-08-01T09:48:33.621148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:33.810635Z","title":"A strategic framework for customer relationship management.Journal of Mar- keting, 69(4):167–176, 2005","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.810635Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:697728e3c69f9a352e06f513a749715934d6a197b0172738c3a8e506c38979ee","observation_id":"cd047fb7-836c-4c39-b083-fd233a817b42","resolution":{"observed_at":"2026-08-01T09:48:33.810635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07831","last_updated":"2021-05-22T08:50:53Z","snapshot_observed_at":"2026-08-21T02:39:51.996961Z","submitted_at":"2021-02-15T20:11:42Z","title":"NeuralNDCG: Direct Optimisation of a Ranking Metric via Differentiable Relaxation of Sorting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.07831","snapshot_observed_at":"2026-08-01T09:48:33.984266Z","title":"Neu- ralndcg: Direct optimisation of a ranking metric via differentiable relaxation of sorting.arXiv preprint arXiv:2102.07831, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:33.984266Z"},"links":{"cited_paper":"/paper/2102.07831","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:e79ca3876a7c73b4646fae5efb484e5e7ec2737eb23a6d54211808c1df1eb7b2","observation_id":"35e80ac1-5628-42fe-b4ce-d5cdf76e3ae4","resolution":{"observed_at":"2026-08-01T09:48:33.984266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:34.112603Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:34.112603Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:70e14f6e057922c3935da05770514cb0c955173dffb79b3f93c93fe36f474f28","observation_id":"a6077ef4-c32e-49db-a74e-0070c6c21a48","resolution":{"observed_at":"2026-08-01T09:48:34.112603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:34.249374Z","title":"Di- rect preference optimization: Your language model is se- cretly a reward model.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:34.249374Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:7c03eee5dc4b642120e5a25148abe873060b8aa83386c1546212195dc22bd229","observation_id":"5ab4cbba-444c-4fc6-a69a-0ebae478db63","resolution":{"observed_at":"2026-08-01T09:48:34.249374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:34.394734Z","title":"Recommenda- tions as treatments: Debiasing learning and evaluation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:34.394734Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:ecbf9a337e74f4b1c0bbfb89df31f21e5420dc6b4caedd62a256a9d7f63e219b","observation_id":"8e6ffee7-396d-450f-8e17-5e6f7defea20","resolution":{"observed_at":"2026-08-01T09:48:34.394734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T09:48:34.538403Z","title":"Proximal policy optimiza- tion algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:34.538403Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:ac42417d659d5ded1ed61fa1dd2569ca8980f0af94fb2878ef7d71cfad2dbfa5","observation_id":"3a2bfd70-b25c-4a0a-99ae-656c25b6971a","resolution":{"observed_at":"2026-08-01T09:48:34.538403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:34.732062Z","title":"Online learning and online con- vex optimization.Foundations and Trends in Machine Learning, 4(2):107–194, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:34.732062Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:a32227f12669f1276a449c281f9ed63e20541f2bed344e05cda673fc2b3c0da2","observation_id":"e236ce5f-43fe-487c-817e-ee49f33b18e9","resolution":{"observed_at":"2026-08-01T09:48:34.732062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T09:48:34.895002Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:34.895002Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:bf1d51c028fb2a2b29d7298fb068369220212f890b7127fff10b4199ab8c08dd","observation_id":"7b020d30-44de-4aba-9e06-0004b83a754e","resolution":{"observed_at":"2026-08-01T09:48:34.895002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:35.023181Z","title":"Autoint: Automatic feature interac- tion learning via self-attentive neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.023181Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:690a18682161f2bb742c64c937c5cfda8e702b0566447e46bbd2aa63335ba36e","observation_id":"65b36fa1-913e-4d98-b5d8-18eebb7f937a","resolution":{"observed_at":"2026-08-01T09:48:35.023181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:35.157585Z","title":"asllr: Llm based leads ranking in auto sales.arXiv preprint arXiv:2510.21713, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.157585Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:674e34b348b980bc4cd74c2245d1ca259400384eacd00b7b2909ed1ab7c574fb","observation_id":"7ec58137-493c-43ba-bfaf-926871265cd9","resolution":{"observed_at":"2026-08-01T09:48:35.157585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:35.296883Z","title":"Dcn v2: Improved deep & cross net- work and practical lessons for web-scale learning to rank systems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.296883Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:7e90b03286176f0cdbf3a614c852b049f3eb2cd2456f4e675403882e49c29374","observation_id":"8930892b-d052-488a-8d58-45b6c319c7cb","resolution":{"observed_at":"2026-08-01T09:48:35.296883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:35.453686Z","title":"Deep & cross network for ad click predictions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.453686Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:94dc6bf614f5b6e8b9c1d63bb6af3ce4664520a51f1351b65e6933e515f0b5ee","observation_id":"1feea294-1e16-488c-a1cf-c0d73790f2bc","resolution":{"observed_at":"2026-08-01T09:48:35.453686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:35.599701Z","title":"Univer- sity of California at Berkeley, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.599701Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:8a7178c2f7cff459439993e6add06656579a4fddea3dd759b20bf1aeec6e3a32","observation_id":"e99102fa-7ccb-4f2b-a406-eeeba2935dca","resolution":{"observed_at":"2026-08-01T09:48:35.599701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:35.743657Z","title":"Listwise approach to learning to rank: theory and algorithm","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.743657Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:8390f0d989729b72f7d368214e7aeed38659076818e940d17cb8e65ba007e005","observation_id":"fc3a6291-cb37-4619-bf9c-d6e5aad7b1e1","resolution":{"observed_at":"2026-08-01T09:48:35.743657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05093","last_updated":"2025-09-03T09:44:46Z","snapshot_observed_at":"2026-08-20T23:11:36.299619Z","submitted_at":"2025-08-07T07:21:46Z","title":"An End-to-End Multi-objective Ensemble Ranking Framework for Video Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05093","snapshot_observed_at":"2026-08-01T09:48:35.937824Z","title":"An end-to-end multi-objective ensemble ranking frame- work for video recommendation.arXiv preprint arXiv:2508.05093, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:35.937824Z"},"links":{"cited_paper":"/paper/2508.05093","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:2da4384613828d5aff410d131e537bb6f5ccbe665f6a58ea4afebf3233995b1e","observation_id":"44627de0-f5e1-434c-808e-500a09ad035e","resolution":{"observed_at":"2026-08-01T09:48:35.937824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:36.112460Z","title":"Auro: Reinforcement learning for adaptive user retention op- timization in recommender systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:36.112460Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:bb77ad91867c402ff133e2066dcd253394e8260b232693856517de1b79080903","observation_id":"d3a1f92e-c68d-4b21-9636-d67ac06f5460","resolution":{"observed_at":"2026-08-01T09:48:36.112460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04387","last_updated":"2026-06-03T03:05:57Z","snapshot_observed_at":"2026-08-13T18:55:57.394754Z","submitted_at":"2026-06-03T03:05:57Z","title":"Rethinking Sales Lead Scoring with LLM-based Hierarchical Preference Ranking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.04387","snapshot_observed_at":"2026-08-01T09:48:36.253837Z","title":"Rethinking sales lead scoring with llm-based hierarchical preference rank- ing.arXiv preprint arXiv:2606.04387, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:36.253837Z"},"links":{"cited_paper":"/paper/2606.04387","citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:74df884d1f5a2741b95de3b4c21c2557f1d9d0ffa2c678723e45af298d72df14","observation_id":"a5d2948d-c3af-4744-854d-9b56485fe239","resolution":{"observed_at":"2026-08-01T09:48:36.253837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:48:36.434783Z","title":"Towards disentangling relevance and bias in unbiased learning to rank","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T09:48:36.434783Z"},"links":{"citing_paper":"/paper/2607.20655"},"observation_digest":"sha256:00926730e88a0cae520bf1df3053a23381a99091dc7a1917ab95c1f9cc52ae7b","observation_id":"d4da5969-fea9-4447-a9ad-1391c184231c","resolution":{"observed_at":"2026-08-01T09:48:36.434783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20655","last_updated":"2026-07-22T18:26:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T04:21:31.484151Z","submitted_at":"2026-07-22T18:26:57Z","title":"SalesLoop: Reinforcement Learning from Performance Feedback for Sales Lead Ranking"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2607.20655."}