{"as_of":"2026-08-18T23:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2215933f7d7ffd6879af61df919634122cecec74f131f5920a4f43b6e2e4bd2b","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:30:13.387444Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:16:40.864431Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16355","snapshot_observed_at":"2026-08-01T12:16:34.627933Z","title":"N., Tavker , S., & Efimov , D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19640","last_updated":"2026-07-22T00:21:36Z","snapshot_observed_at":"2026-08-11T07:19:45.228575Z","submitted_at":"2026-07-22T00:21:36Z","title":"AGNFormer I: Reconstruction of AGN spectra using a probabilistic transformer model","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T12:16:34.627933Z"},"links":{"cited_paper":"/paper/2508.16355","citing_paper":"/paper/2607.19640"},"observation_digest":"sha256:6fa6e0d08cbfd73bcb7a1efae86196d4cc2655d94316b3e648926c93e154a4e9","observation_id":"a31613dc-6b12-403c-899c-43b146bfe8cf","resolution":{"observed_at":"2026-08-01T12:16:34.627933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"cited_work":{"arxiv_id":"2508.16355","doi":"10.48550/arxiv.2508.16355","metadata_source":"pith","pith_arxiv_id":"2508.16355","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Probabilistic Pretraining for Neural Regression","venue":"cs.LG","work_id":"09d03a5d-62f3-41ec-a0e0-2d466b2fba70","year":2025},"citing_paper":{"arxiv_id":"2607.19640","last_updated":"2026-07-22T00:21:36Z","snapshot_observed_at":"2026-08-11T07:19:45.228575Z","submitted_at":"2026-07-22T00:21:36Z","title":"AGNFormer I: Reconstruction of AGN spectra using a probabilistic transformer model","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-01T12:16:40.864431Z"},"links":{"cited_paper":"/paper/2508.16355","citing_paper":"/paper/2607.19640"},"observation_digest":"sha256:a4773f67d71169c1db5fe8874818904dd9569ec2cefe7ffa26e22961b40aa96a","observation_id":"e749632b-27a6-4606-ba89-10aed8270ac0","resolution":{"observed_at":"2026-08-01T12:18:29.828129Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.16355/citation-record","integrity":"/paper/2508.16355/integrity","json":"/paper/2508.16355/citation-record.json","paper":"/paper/2508.16355"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:23.303456Z","title":"KEEL data-mining software tool: Data set repository, integration of algorithms and experimental analysis framework","venue":null,"work_id":"3e94aced-6c7c-4e3e-838f-0bdd870df91b","year":2011},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:09.830530Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:0e40014ab7c588130e90c7dfd87e1a8c824c1e945e12166fa446550b6978edb1","observation_id":"2d8216a6-e434-4e3b-818e-ac724b552fcf","resolution":{"observed_at":"2026-08-05T17:30:23.377515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:23.126310Z","title":"1st place solution for the regression with a flood prediction dataset","venue":null,"work_id":"e22ae49f-0a47-44ea-8c0e-d283638e8af4","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:09.916056Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:e890fcef6cbf62ccc29873e0378c84620f3f79ab7a2a9fb0f23ae432d02ae3ec","observation_id":"177817ee-8982-454a-b22a-39128a0fa5f4","resolution":{"observed_at":"2026-08-05T17:30:23.210550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07815","last_updated":"2024-11-04T17:42:45Z","snapshot_observed_at":"2026-08-16T12:24:20.200568Z","submitted_at":"2024-03-12T16:53:54Z","title":"Chronos: Learning the Language of Time Series","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07815","snapshot_observed_at":"2026-08-05T17:30:10.006806Z","title":"Maddix, Michael W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.006806Z"},"links":{"cited_paper":"/paper/2403.07815","citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:fd3d013529d88d8b5467a995d71deeb9ce0b72814eefdb8e0caa0fa12abc0be5","observation_id":"92d66b43-9ab7-4ae3-8c03-32f2828c56b9","resolution":{"observed_at":"2026-08-05T17:30:10.006806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:22.896642Z","title":"Arik and Tomas Pfister","venue":null,"work_id":"9608f1da-8493-4a06-a234-a77eaee2c4d3","year":2021},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.088047Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:1adeaeaf5f40fd9c0ef8a851c024012eac4ffeba6b0e3712c8b0fdf3a88f001b","observation_id":"00f9c0bc-20a1-4127-a0de-4f34376da26c","resolution":{"observed_at":"2026-08-05T17:30:22.992594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:22.738502Z","title":"House rent prediction dataset, 2022","venue":null,"work_id":"49c30f97-12ac-4f52-b332-f237b518924b","year":2022},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.165588Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:bcb5f67991e7f22cd03dd2f376a31f2d99019dab17af361e727c0b934b2227fd","observation_id":"45212f30-7307-4718-862b-1c78125b1e6b","resolution":{"observed_at":"2026-08-05T17:30:22.804068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:10.250031Z","title":"Random forests","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.250031Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:aca404f99d29458a16f5a5aa94e3e0bd9943f110ce6e6a0012d78811669be7bb","observation_id":"9b8bfe97-19ef-4daf-b468-366248f156fc","resolution":{"observed_at":"2026-08-05T17:30:10.250031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:10.333300Z","title":"Xgboost: A scalable tree boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.333300Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:70a18dff4151ae484f7ffc8979a07e383e723e7c46a78af733695e5655fb6f05","observation_id":"5034e300-aafb-4f29-87f6-8cc368a7ac80","resolution":{"observed_at":"2026-08-05T17:30:10.333300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:22.554882Z","title":"ps-s4e4: Eda | lightgbm | importance plots","venue":null,"work_id":"cbc9fb7f-9ee1-4090-a8d9-7ebbbff49bad","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.410853Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:e6c3da8e73a11e390536f9c5b7f63e6870e1c7108b2fcade3cb64d1f48b98aba","observation_id":"45378ed8-c806-4d68-a26e-f59bf0e25d98","resolution":{"observed_at":"2026-08-05T17:30:22.620012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:22.311122Z","title":"Ames, iowa: Alternative to the boston housing data as an end of semester regression project","venue":null,"work_id":"b8c5d375-b1c9-457d-8668-f8f33eb15d77","year":2011},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.516800Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:d101d993f8bc61af6b217c355d591a5cb9fb79fe1b23f1fe1b632d676926d85a","observation_id":"8ba98eea-5e06-427c-940d-98ace40bf746","resolution":{"observed_at":"2026-08-05T17:30:22.429287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:22.209344Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"41ad4c5f-783d-4ce9-b48f-623f1f318a0d","year":2019},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.600906Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:97650f1fea5e46f2f817e07a55e0d36c3fcb86e60793b2dffcb237f6c6f88b44","observation_id":"9a4c9116-80b2-4e6d-a641-a1fcbaffb166","resolution":{"observed_at":"2026-08-05T17:30:22.231932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:21.927009Z","title":"Non-Uniform Random Variate Generation","venue":null,"work_id":"ca0049bf-3f95-422a-a83c-ad3b6c89bc88","year":1986},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.679050Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:c9d922e7d09104c9222840c3643f27ed66c75916ca888665ec5ad209c820b9ab","observation_id":"30a89797-35ec-44e4-b1e8-63a22d1efd6f","resolution":{"observed_at":"2026-08-05T17:30:22.079679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:21.630719Z","title":"Flood prediction factors","venue":null,"work_id":"c633aa93-18a0-4d36-8053-3d7f951b827e","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.738079Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:85d71c0bb354a6a57206ce2b91bf4eeb56d37a6504805a748cc66810c296c528","observation_id":"1ce35e98-abda-4f9f-93f2-adcca7b5b0e6","resolution":{"observed_at":"2026-08-05T17:30:21.752493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:21.332788Z","title":"Uci machine learning repository: Abalone data set, 2019","venue":null,"work_id":"2e526fc4-0eca-49f9-b06e-feaa58e54ecf","year":2019},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.839601Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:5a76b96bc7154893d9a1d555a6488c6447ab181e9df7af2bcce8374418b3a51b","observation_id":"c61fd81a-ff6e-404d-968b-b8e810e59713","resolution":{"observed_at":"2026-08-05T17:30:21.499417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:20.945650Z","title":"Deep neural networks for estimation and inference","venue":null,"work_id":"40a618c3-ed41-4bc7-96cb-4506e1f77e61","year":2021},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.874537Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:16248185f3d695c966b7fb64b5125c436bbdef09dd41a88538874b028bc93b22","observation_id":"f16504e5-fc81-4f8f-8e25-15bcd900da7c","resolution":{"observed_at":"2026-08-05T17:30:21.156623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:20.546140Z","title":null,"venue":null,"work_id":"4d7cde96-6fb9-4aa2-988a-f58c8c488863","year":2018},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.879951Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:46ba77542611e5097809e6a4e4751c26e09116b84c5b4595591aca843a2e2c6c","observation_id":"14943201-7d05-4eef-9f32-a940f98d8215","resolution":{"observed_at":"2026-08-05T17:30:20.772196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01622","last_updated":"2018-07-04T14:49:46Z","snapshot_observed_at":"2026-08-14T18:55:44.864275Z","submitted_at":"2018-07-04T14:49:46Z","title":"Neural Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01622","snapshot_observed_at":"2026-08-05T17:30:10.991073Z","title":"Rezende, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:10.991073Z"},"links":{"cited_paper":"/paper/1807.01622","citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:ad428e53e69da0bbe60075f3c4c4c56078859c7b68c2f44e84a00ae238222f50","observation_id":"7d785a45-9ca2-4cd6-b3b5-60f7163dbb67","resolution":{"observed_at":"2026-08-05T17:30:10.991073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:20.233883Z","title":"Timegpt-1, 2023","venue":null,"work_id":"facde1c0-9189-4f3e-b12f-331333e9f660","year":2023},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.078970Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:5ed14791e8584df2b30cb0b4a2ae92c860bbf51b3c2a508c6bd526022446e0d4","observation_id":"6781db4d-f5bc-4e16-88d7-8e6ef2c5e347","resolution":{"observed_at":"2026-08-05T17:30:20.359906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.964626Z","title":"Comparing density forecasts using threshold-and quantile-weighted scoring rules","venue":null,"work_id":"e7337f67-f861-48f3-9e28-d8ea442cc350","year":2011},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.121452Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:5c6148ea15cd931abfa311741966d2644ff8f2f39afe1287600cd735dab00698","observation_id":"0907ccff-1238-4d0e-9846-c2e94bb766fe","resolution":{"observed_at":"2026-08-05T17:30:20.069702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.808108Z","title":"Why do tree-based models still outperform deep learning on typical tabular data? In Proc","venue":null,"work_id":"9265c8d2-482c-4f34-8e88-dc629deae9fe","year":2022},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.143461Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:32ee6cf210a7a0ea695443603a491b7328922ceba4dd0266f95365a7a4a730b9","observation_id":"7924e533-c85c-40ec-ad4c-125fec2f629d","resolution":{"observed_at":"2026-08-05T17:30:19.876210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.577411Z","title":"1st place solution for the regression with an abalone dataset competition","venue":null,"work_id":"c7798784-a96b-48af-97ae-f7e37ec6220d","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.166800Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:2a543a80a97d873ca947b11e150eca96b51536c55f709c08304af57d142b60d1","observation_id":"a5a25a8d-8552-43dc-b4e6-84f7e47e968d","resolution":{"observed_at":"2026-08-05T17:30:19.685287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.435869Z","title":"Tab PFN : A transformer that solves small tabular classification problems in a second","venue":null,"work_id":"9924640b-a592-4497-bfb0-03eaf5868856","year":2023},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.192392Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:e0b7b1cbab61cc5c1a6d7042ed85b0c545c6caeed54733bed4b741178c328d0c","observation_id":"d02fbc4d-23eb-4d1d-a397-75d755f57df2","resolution":{"observed_at":"2026-08-05T17:30:19.481594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.306241Z","title":"TabTransformer : Tabular data modeling using contextual embeddings","venue":null,"work_id":"ebab1be7-8a07-45a2-9bdc-1b25641cbc2e","year":2021},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.225268Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:e12a097985e802a5ebde45db25191260f915d9eb832c30e6b57e1a12ab1f37b7","observation_id":"917e0ab5-0968-4bd3-b3fe-95e2c56b8006","resolution":{"observed_at":"2026-08-05T17:30:19.370880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.177302Z","title":"Well-tuned simple nets excel on tabular datasets","venue":null,"work_id":"4f1a39d9-b74a-4259-a4f8-069f27d6f90d","year":2021},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.269056Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:dd2190d7e32d6ac6e64a44679149f2cdc6cd9b5c5542dab4203709e498141c9c","observation_id":"f1d096a4-8d8b-4eca-b40f-ec68f2b5a53f","resolution":{"observed_at":"2026-08-05T17:30:19.230340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:19.054904Z","title":"Kaggle datasets, 2024","venue":null,"work_id":"205335dc-7f57-4fc9-abf1-b29b4d87a1ac","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.298308Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:c4001bc3d764b812eea675c099cdc7913b0de5a328593d83632800c824334b44","observation_id":"635dc81c-7569-4679-a048-35f4dcd8e8ef","resolution":{"observed_at":"2026-08-05T17:30:19.113734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:18.917360Z","title":"Linear convergence of gradient and proximal-gradient methods under the polyak-lojasiewicz condition","venue":null,"work_id":"1b18cff2-a6c6-4fbe-9f34-3b0e95db73e7","year":2016},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.339618Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:55bcbac441a5f30352b04f53627d32ee7ef8a6816d6d2725af89a6d5886420f9","observation_id":"c41de291-070b-4c75-909a-5bc4bbd044e1","resolution":{"observed_at":"2026-08-05T17:30:18.995946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:18.695681Z","title":"Lightgbm: A highly efficient gradient boosting decision tree","venue":null,"work_id":"7534c4a3-2e82-4d6c-a603-9c44d7bc4303","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.431411Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:8ca0e78edce4cf0977a92d37effa8d3f3e5939e5d31219415f82a1e7015eb299","observation_id":"22949eee-d8df-447a-824f-7b80bd31bd4b","resolution":{"observed_at":"2026-08-05T17:30:18.797617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:18.537414Z","title":"UCI machine learning repository, 2017","venue":null,"work_id":"7f1cd732-f1e0-4bfc-ab3a-37e96ab76210","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.489073Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:e3bbdec599f6aa9a6c35d4519807a4aafff894c913f038b0a8082db2736d5ab1","observation_id":"fde76c24-add7-455f-8031-7f7808876ac6","resolution":{"observed_at":"2026-08-05T17:30:18.601971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:18.362051Z","title":"Transfer learning with deep tabular models","venue":null,"work_id":"8d680108-0909-4b32-a3f2-966487cd5949","year":2023},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.526697Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:286815f10d0d0e6bd277c7f99eb1fe0aaaad809b8f88d8678c3d0d8dfbb96761","observation_id":"d1c273db-f29f-4354-a24c-f923672f50b7","resolution":{"observed_at":"2026-08-05T17:30:18.446332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:11.581467Z","title":"Tabdpt: Scaling tabular foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.581467Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:3954ff855342cfa81abf742d494015afbc2d0d51caef5d8ae8e564c243f6c40c","observation_id":"fef218c8-bb73-4c28-ac4d-de116a9b46c2","resolution":{"observed_at":"2026-08-05T17:30:11.581467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:18.188394Z","title":"Xgb|cat|lightgbm","venue":null,"work_id":"95dc841f-28ba-44a2-95b0-155eaf9309d2","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.612018Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:b1252a43520878a1eda3ef68786050bd587fcb0b37357be92e1f65bd2bdfcd38","observation_id":"5f9c5294-4a62-4a46-b57f-91f0065fe5d9","resolution":{"observed_at":"2026-08-05T17:30:18.267661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:18.067303Z","title":"Amazon price and product data: Electronic commerce, 2015","venue":null,"work_id":"0364225e-76d4-4e29-b5c3-8dd504c4916f","year":2015},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.664560Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:6af70d7a6e5f6533bc49e677f8aadba6342320d3bb45e9611b3015c1cdf0cc83","observation_id":"f5def6e7-2a91-4651-8592-85f7ad79cb18","resolution":{"observed_at":"2026-08-05T17:30:18.120326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:17.862310Z","title":"McInnes , J","venue":null,"work_id":"4fbb01b8-e31e-42fe-bff3-468917ec0aca","year":2018},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.695114Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:abbd453790582517a721b9d1ab624c9b3df990038a8a5c20a906acdd61b52f7e","observation_id":"20db6522-6741-4c69-a5d1-b489a1ab1bdb","resolution":{"observed_at":"2026-08-05T17:30:17.939607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:17.676387Z","title":"Baseline v1 | catboost","venue":null,"work_id":"e6d78150-71a1-4e97-821c-2a5744b2c432","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.719430Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:fdd05d555c18d23f8daf44aa0e47231b1782036dc363022e651fa035f3392e78","observation_id":"a3b21994-d07e-4e16-9a51-ca713cd3525d","resolution":{"observed_at":"2026-08-05T17:30:17.743603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:17.530306Z","title":"Transformers can do Bayesian inference","venue":null,"work_id":"fb9bf721-a18b-446b-8caf-d88c82b19d8e","year":2022},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.756303Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:de50b22cc534cab827493968a0e340a9348361804fc466eb900267ae9f721667","observation_id":"800a31fc-9150-4969-a179-fa7835d8baa1","resolution":{"observed_at":"2026-08-05T17:30:17.603865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:17.387765Z","title":"TabPFN: A Transformer that solves small tabular classification problems in a second","venue":null,"work_id":"5ed5166e-4efd-429b-ba0d-532dc7c365f1","year":2025},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.797083Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:a4c5e8fbf2e10188d6c342130fd2a728d010ed073c3d5ed2dd252673742c6375","observation_id":"9c5e93b0-163b-49d8-9a00-df71ea513753","resolution":{"observed_at":"2026-08-05T17:30:17.469870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:17.242145Z","title":"Occupancy flow: 4d reconstruction by learning particle dynamics","venue":null,"work_id":"2a756e36-61d2-41b5-a1c4-c9b1cdb887fd","year":2019},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.838020Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:6fa4a5f8d801596093513bce5579aa9b9cc15fcb7fbd084cc1517de3717d6fa4","observation_id":"f9bcca93-f2ca-4b7a-9111-8383ab1f99c4","resolution":{"observed_at":"2026-08-05T17:30:17.304023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:17.054974Z","title":"Olson, William La Cava, Patryk Orzechowski, Ryan J","venue":null,"work_id":"28685ff2-e516-4613-b79f-2e99a1770a43","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.916273Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:97c1e45cc009cbf207ed57c1644ece1ec01f3929a35c1e41677fd39a4ac2384e","observation_id":"99396cc1-a2dc-4000-b042-7a7caac208dc","resolution":{"observed_at":"2026-08-05T17:30:17.141426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:11.986364Z","title":"Olson, William La Cava, Patryk Orzechowski, Ryan J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:11.986364Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:981cb3bdc42fa14207cfb925dc4d36a2eb235f074d86a3bebe7bab2283676d80","observation_id":"f63879a3-e6ba-431e-ad20-ce15194eeb46","resolution":{"observed_at":"2026-08-05T17:30:11.986364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:16.906185Z","title":"Wind dataset, n.d","venue":null,"work_id":"898a8eb0-56d5-4ef2-928a-b1916e2a3df8","year":null},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.076949Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:6468b8d8717b4e4f85cbbe74f3ef84ff51d1c81c048eb2f4f8517d302efab46f","observation_id":"2a58bdea-ef42-4323-b264-31e3bd95ba61","resolution":{"observed_at":"2026-08-05T17:30:16.988242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:16.747875Z","title":"Oreshkin, Florent Bocquelet, F \\' e lix G","venue":null,"work_id":"2a336acd-a63d-47e1-aeed-159ea3d69ea8","year":2022},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.174176Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:e1e783ffda0864d6390c68127b6c8422e447c54d1a042e6d8208be9aec4afc07","observation_id":"8874574a-b577-4b63-87c1-22cea560dde0","resolution":{"observed_at":"2026-08-05T17:30:16.819576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:16.586717Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":"ca8cc8af-3c18-4356-bd48-1c8cc749890f","year":2018},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.283599Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:905164d915b515fec208b009e605f5292a573cdf121c663e879ce5170946fdc2","observation_id":"7b9c0a42-c2ce-45b9-a3ad-01054ed51743","resolution":{"observed_at":"2026-08-05T17:30:16.649407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:16.415024Z","title":"Catboost: unbiased boosting with categorical features, 2019","venue":null,"work_id":"1144f925-3ef5-4709-b08b-44505e082b6a","year":2019},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.384603Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:dcf09b2f5b7e8020e7ac6e84affb63effae3a3b0ccc635b02b59391b21d668bf","observation_id":"a764af68-9f1b-4703-8f8d-8e33e0daec62","resolution":{"observed_at":"2026-08-05T17:30:16.490332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:16.232580Z","title":"Qi, Hao Su, Kaichun Mo, and L","venue":null,"work_id":"90285d3d-092d-4658-a238-57e1e57b5bae","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.454468Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:d4a8eefc747ce8339b9ca022ddad8559a7050bf2ba34940b7d694a521d361c28","observation_id":"93efa09b-3820-4a18-9d7c-e8067ad59698","resolution":{"observed_at":"2026-08-05T17:30:16.308664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:16.062447Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"486fe62e-2c83-45cf-8102-c5fa75cd6a80","year":2021},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.545616Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:2a6f958d400f46c6b249b61050ed114201a51080d5640a108cb4082ec5283185","observation_id":"9a34d602-4084-4cc4-ae04-9b4e8779eba3","resolution":{"observed_at":"2026-08-05T17:30:16.128499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:15.872486Z","title":"Dai, Nissan Hajaj, Michaela Hardt, Peter J","venue":null,"work_id":"828c23b9-e602-482f-b47e-d8bb77f3edee","year":2018},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.591143Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:489eaee9c28b3c565764a3fea94d247cad6b6871aaadf67ded24fccad6fc4315","observation_id":"1a21ac27-f531-4587-a481-eebae14eb1e7","resolution":{"observed_at":"2026-08-05T17:30:15.970818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:15.695349Z","title":"Regression with an abalone dataset","venue":null,"work_id":"5194c2f3-dae3-4d92-8c3d-e681bcb2ce30","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.669954Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:4609ea30a1f7964cf7c8c8a269bda6a8d5aeaef9acc55e2e70727805588316b4","observation_id":"e022b3d6-b5b0-42b4-a5fc-febc6c0716b5","resolution":{"observed_at":"2026-08-05T17:30:15.767429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:15.417833Z","title":"Regression with a flood prediction dataset","venue":null,"work_id":"54215d01-d869-49af-8dc4-e028875e0726","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.735220Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:fdb6b7c17c9993060c863e2f30f8d472b5f7f0906dce4b016e8584b97e540c5f","observation_id":"beb74c02-972c-461e-a90c-b36674d8a828","resolution":{"observed_at":"2026-08-05T17:30:15.537989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.00058","last_updated":"2021-04-06T12:37:35Z","snapshot_observed_at":"2026-08-16T19:02:05.888878Z","submitted_at":"2020-11-30T19:21:44Z","title":"PMLB v1.0: An open source dataset collection for benchmarking machine learning methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.00058","snapshot_observed_at":"2026-08-05T17:30:12.766670Z","title":"Pmlb v1.0: an open source dataset collection for benchmarking machine learning methods","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.766670Z"},"links":{"cited_paper":"/paper/2012.00058","citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:a2641337e77a11bb24ccf81549274f4cb0050f8c9213f708ae8f4314f3d4f65d","observation_id":"1c4e39e2-e8b0-4407-8f68-a9e4a0004124","resolution":{"observed_at":"2026-08-05T17:30:12.766670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:15.243864Z","title":"Flood forecasting with xgboost","venue":null,"work_id":"d097e2af-e3e6-4a52-b384-53238e148492","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.808774Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:7108726107a8ce17115b892c744d6171981f14ac5b38e298fdf52925ccf3db86","observation_id":"00238827-0ac1-4d0d-ae93-d53921cdb3ca","resolution":{"observed_at":"2026-08-05T17:30:15.326449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:15.080479Z","title":"Why nns is better than gbds? https://www.kaggle.com/competitions/playground-series-s4e4/discussion/496471\\#2767909, 2024","venue":null,"work_id":"3eea1df0-896f-4722-86b5-547755468deb","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.878853Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:f2e3f28d86c40ec27ff7859a8b8a2d357474436fcc0c8c3a010fb97d9a8c2890","observation_id":"33e34fce-2b7d-423f-a9bf-29129c59b5c7","resolution":{"observed_at":"2026-08-05T17:30:15.159275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17451","last_updated":"2024-10-04T13:56:14Z","snapshot_observed_at":"2026-08-17T02:41:11.628622Z","submitted_at":"2024-04-26T14:43:19Z","title":"Any-Quantile Probabilistic Forecasting of Short-Term Electricity Demand","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17451","snapshot_observed_at":"2026-08-05T17:30:12.943219Z","title":"Oreshkin, Paweł Pełka, and Grzegorz Dudek","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.943219Z"},"links":{"cited_paper":"/paper/2404.17451","citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:a3412ab91ed1f858dfbe223d5274138d819144badec749b1c7d6bacd16269bf1","observation_id":"436f1954-bc11-462b-9d88-006f5cc4c1d9","resolution":{"observed_at":"2026-08-05T17:30:12.943219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:14.908340Z","title":null,"venue":null,"work_id":"8242cb12-69f5-40e5-beb6-50cc7d08a35e","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:12.986268Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:c2a5320a5257bc049e39fa5b44e4199bd7943d313c97dccf69d011a53ceb44a3","observation_id":"7c717547-1f36-4171-a648-945795a238d7","resolution":{"observed_at":"2026-08-05T17:30:14.972516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:14.647483Z","title":"Monocular, One-stage, Regression of Multiple 3D People","venue":null,"work_id":"349f4f14-f085-484c-be0b-c2e3d9ee5eb0","year":2021},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:13.094065Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:abceadb8236bb06e0db44725b89637d7088dbae55f765b85be28eb301aef2980","observation_id":"74790b11-d629-424e-8b5c-d029a05beb8e","resolution":{"observed_at":"2026-08-05T17:30:14.795057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1190.26411","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:13.576814Z","title":"van Rijn, Bernd Bischl, and Luis Torgo","venue":null,"work_id":"11d8bf34-b7fb-45fd-8ece-14452cbd4fa9","year":2013},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:13.156099Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:a5fa4c56aec3413f06d9631a76e5eaa9f216dd89f922f04891614e5bacc9b001","observation_id":"639d9f39-c78d-4aa9-b243-59b1e0d8a79d","resolution":{"observed_at":"2026-08-05T17:30:13.634328Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:14.484984Z","title":"Attention is all you need","venue":null,"work_id":"404a32fd-d3ab-4712-9a43-11b6aece928b","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:13.230767Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:050b9a7da22a84ff314ffaec84a02574ff662969e7149ca82844fb9067f22f1b","observation_id":"ac033d83-a6e5-480e-8beb-865fec1869de","resolution":{"observed_at":"2026-08-05T17:30:14.559842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:14.313187Z","title":"S4e4 | abalone | catboost","venue":null,"work_id":"c6600d77-be72-4d02-a4c5-b3cbfb0b3eea","year":2024},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:13.278059Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:2cc66498e82e9097e9ffc1b1474e96bad6f4bfd2583e6f23ee78e629ccd6d193","observation_id":"79aff961-0786-4cbb-ba93-e65e5ed0dc22","resolution":{"observed_at":"2026-08-05T17:30:14.394928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:14.120138Z","title":"Deep sets","venue":null,"work_id":"e3c18ffd-84e2-49f3-a331-c0cb2cd1c3e0","year":2017},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:13.331427Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:ce0b9f266a85cc4ae5ede3ea68e7322a56a8ed3a6e8343a212f1bc14bcb300f8","observation_id":"05df92f6-53f3-43bf-bd62-15734e8bf9ca","resolution":{"observed_at":"2026-08-05T17:30:14.217287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:30:13.984633Z","title":"Openfe: automated feature generation with expert-level performance","venue":null,"work_id":"667f2d20-0f39-4a45-aa29-eb20ec0e8aa4","year":2023},"citing_paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T17:30:13.387444Z"},"links":{"citing_paper":"/paper/2508.16355"},"observation_digest":"sha256:1ae957e6358dfffd57589ad5cbfa9ce6d80b25834c4c4a9abda016a8e60d913c","observation_id":"0f9249dc-c62a-4414-8e6e-204c5e0428be","resolution":{"observed_at":"2026-08-05T17:30:14.060658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.16355","last_updated":"2025-08-22T13:03:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T13:12:41.299363Z","submitted_at":"2025-08-22T13:03:04Z","title":"Probabilistic Pretraining for Neural Regression"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":47},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2508.16355."}