{"as_of":"2026-08-08T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:72cb9ed525718b32368df156e3015d39d3d00cb6534a211bc71b7e196d52a894","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:47.958225Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:34:47.760875Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T08:04:29.090042Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"cited_work":{"arxiv_id":"2507.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07829","snapshot_observed_at":"2026-06-30T08:04:29.090042Z","title":"Towards benchmarking foundation models for tabular data with text","venue":null,"work_id":"e217149e-75f7-4054-b53f-5e33f8febd66","year":2025},"citing_paper":{"arxiv_id":"2605.12292","last_updated":"2026-05-12T15:47:50Z","snapshot_observed_at":"2026-07-30T09:22:37.068920Z","submitted_at":"2026-05-12T15:47:50Z","title":"STRABLE: Benchmarking Tabular Machine Learning with Strings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T05:13:15.039160Z"},"links":{"cited_paper":"/paper/2507.07829","citing_paper":"/paper/2605.12292"},"observation_digest":"sha256:712c52390dd56dcdafb5e9654d4a333843cc37885d3c0e07ff5073733f949654","observation_id":"036e564d-2896-4d9d-a8c4-e74202eb4aa7","resolution":{"observed_at":"2026-05-13T05:17:18.441754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"cited_work":{"arxiv_id":"2507.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07829","snapshot_observed_at":"2026-06-30T08:04:29.090042Z","title":"Towards benchmarking foundation models for tabular data with text","venue":null,"work_id":"e217149e-75f7-4054-b53f-5e33f8febd66","year":2025},"citing_paper":{"arxiv_id":"2606.30410","last_updated":"2026-06-29T14:55:52Z","snapshot_observed_at":"2026-08-03T09:53:02.738738Z","submitted_at":"2026-06-29T14:55:52Z","title":"Beyond IID: How General Are Tabular Foundation Models, Really?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T06:59:14.626274Z"},"links":{"cited_paper":"/paper/2507.07829","citing_paper":"/paper/2606.30410"},"observation_digest":"sha256:330d3eb0f124cc6be970983863d41fe65704eb66efb880ef5e540558a37959c6","observation_id":"378dff40-5ec7-4857-906e-3d4ce8efecff","resolution":{"observed_at":"2026-06-30T07:04:21.420092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"cited_work":{"arxiv_id":"2507.07829","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07829","snapshot_observed_at":"2026-06-30T08:04:29.090042Z","title":"Towards benchmarking foundation models for tabular data with text","venue":null,"work_id":"e217149e-75f7-4054-b53f-5e33f8febd66","year":2025},"citing_paper":{"arxiv_id":"2606.30452","last_updated":"2026-06-29T15:21:17Z","snapshot_observed_at":"2026-08-02T15:48:26.354478Z","submitted_at":"2026-06-29T15:21:17Z","title":"Exploring Differences Between Tabular Enterprise Data and Public Benchmarks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-30T07:34:47.760875Z"},"links":{"cited_paper":"/paper/2507.07829","citing_paper":"/paper/2606.30452"},"observation_digest":"sha256:70fcca0273fccab15e34423668eb06a5dd6984195d0387e10c4c43867eefff27","observation_id":"4a372cec-af06-47c5-9513-4821a51dd7f5","resolution":{"observed_at":"2026-06-30T08:04:29.091444Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07829/citation-record","integrity":"/paper/2507.07829/integrity","json":"/paper/2507.07829/citation-record.json","paper":"/paper/2507.07829"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:46.629336Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:46.629336Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:05de3853b6ee4d27d11496b7d4585e281cdd2f2abfc9b2d56b6960b12e06a97a","observation_id":"1c7d4019-78e6-4a09-b12b-428e12e41c91","resolution":{"observed_at":"2026-08-06T18:36:46.629336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.03731","last_updated":"2021-11-22T13:58:04Z","snapshot_observed_at":"2026-07-06T05:55:01.476523Z","submitted_at":"2017-08-11T23:28:48Z","title":"OpenML Benchmarking Suites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.03731","snapshot_observed_at":"2026-08-06T18:36:46.741921Z","title":"G., van Rijn, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:46.741921Z"},"links":{"cited_paper":"/paper/1708.03731","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:bb0994f757447e5cfc2886b28ba22990f1047d7fecafe44e98e70a4b09aafc20","observation_id":"baf2414d-065f-4a50-a179-fcdb89fd3b6b","resolution":{"observed_at":"2026-08-06T18:36:46.741921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.04606","last_updated":"2017-06-19T17:41:07Z","snapshot_observed_at":"2026-07-06T05:03:45.255477Z","submitted_at":"2016-07-15T18:27:55Z","title":"Enriching Word Vectors with Subword Information","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.04606","snapshot_observed_at":"2026-08-06T18:36:46.868838Z","title":"Enriching word vectors with subword information, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:46.868838Z"},"links":{"cited_paper":"/paper/1607.04606","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:75fd4264dc743f73a98d5eab5aeb6bf4e5699dde4ef958a8cdc974586cac0b0f","observation_id":"377f81f8-07a2-4e19-8c55-b165bf9a981d","resolution":{"observed_at":"2026-08-06T18:36:46.868838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.052197Z","title":"V., Na, L., Ma, Y., Boussioux, L., Zeng, C., Soenksen, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.052197Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:accfcbfde943db138b5d4949da14173c7779f93c0c5de55587d0fa8c033bd2a5","observation_id":"483d32a2-ff1e-4cbd-a28b-b3533f925e72","resolution":{"observed_at":"2026-08-06T18:36:47.052197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:48.584641Z","title":"and Guestrin, C","venue":null,"work_id":"10cd5dbd-d7ff-4e2d-83df-1d944c3b6983","year":2016},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.160510Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:c56f25da4c8e54eec6896006a6e22a919153437a0fe1c8c616b38194581f02d9","observation_id":"877e9463-acaa-49d1-abe0-80df7238f766","resolution":{"observed_at":"2026-08-06T18:36:48.592767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.06505","last_updated":"2020-03-13T23:10:39Z","snapshot_observed_at":"2026-07-06T09:04:37.917150Z","submitted_at":"2020-03-13T23:10:39Z","title":"AutoGluon-Tabular: Robust and Accurate AutoML for Structured Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.06505","snapshot_observed_at":"2026-08-06T18:36:47.379543Z","title":"Autogluon-tabular: Robust and accurate automl for structured data, 2020 b","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.379543Z"},"links":{"cited_paper":"/paper/2003.06505","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:01558dbc8ea85f74b60bb66c6ca51b5369ebe5fd2893589abb675df12fc9ed89","observation_id":"da1cfbfd-2367-4aa7-b9d3-abe8e32e0193","resolution":{"observed_at":"2026-08-06T18:36:47.379543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12560","last_updated":"2023-11-16T14:12:10Z","snapshot_observed_at":"2026-08-05T19:50:36.254635Z","submitted_at":"2022-07-25T22:34:08Z","title":"AMLB: an AutoML Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12560","snapshot_observed_at":"2026-08-06T18:36:47.491670Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.491670Z"},"links":{"cited_paper":"/paper/2207.12560","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:a047d3d4bf057beadcbc44c677a483d0ab659c91d0e082f35ef60045a2a1ab09","observation_id":"fd806105-fa00-42c0-8498-182df74f00b6","resolution":{"observed_at":"2026-08-06T18:36:47.491670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:48.566662Z","title":"L., Amaral, L","venue":null,"work_id":"fca4572b-c810-4c6e-bb79-a9996880eea5","year":2000},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.546239Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:69c2b6e24ae6f88f83720e8025ba696ff5fe9dadd92bbc0834dcf0ce22530d1f","observation_id":"bacee3e0-ffd2-49d5-a053-b5645203fb63","resolution":{"observed_at":"2026-08-06T18:36:48.572115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09634","last_updated":"2023-12-15T09:23:56Z","snapshot_observed_at":"2026-07-06T17:02:33.830269Z","submitted_at":"2023-12-15T09:23:56Z","title":"Vectorizing string entries for data processing on tables: when are larger language models better?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09634","snapshot_observed_at":"2026-08-06T18:36:47.624023Z","title":"J., and Varoquaux, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.624023Z"},"links":{"cited_paper":"/paper/2312.09634","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:0f4f833973730288aad316a08ffa1ff3108582abe76fe1d2a2b28653debafbda","observation_id":"397e6b2c-c2bc-48c7-9a81-fad9763d348b","resolution":{"observed_at":"2026-08-06T18:36:47.624023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10723","last_updated":"2023-03-17T16:36:53Z","snapshot_observed_at":"2026-08-04T12:44:53.834255Z","submitted_at":"2022-10-19T17:08:13Z","title":"TabLLM: Few-shot Classification of Tabular Data with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10723","snapshot_observed_at":"2026-08-06T18:36:47.741196Z","title":"Tabllm: Few-shot classification of tabular data with large language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.741196Z"},"links":{"cited_paper":"/paper/2210.10723","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:cd50f05a11be7f97869f7ec337bee49adc6801c430e7bc5e6c420f87c5112711","observation_id":"553da31f-b73a-417e-bc29-3f3a0fffff2d","resolution":{"observed_at":"2026-08-06T18:36:47.741196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00655","last_updated":"2023-12-15T17:10:35Z","snapshot_observed_at":"2026-07-06T16:55:41.420301Z","submitted_at":"2023-12-01T15:30:43Z","title":"Machine Learning for Health symposium 2023 -- Findings track","version":3},"cited_work":{"arxiv_id":"2312.00655","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.00655","snapshot_observed_at":"2026-08-06T18:36:48.335964Z","title":"Machine Learning for Health symposium 2023 -- Findings track","venue":"cs.LG","work_id":"86a32318-a32c-4840-b9f8-accfe9804ac6","year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.771782Z"},"links":{"cited_paper":"/paper/2312.00655","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:6b38b50535c7f16c0e8db723c6f7c9a6d9c9c720160b64fe7be739d53750a334","observation_id":"2a0e2f26-28a3-4db7-99dd-1e2047a4d95b","resolution":{"observed_at":"2026-08-06T18:36:48.343264Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.776363Z","title":"u ller, S., Purucker, L., Krishnakumar, A., K \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.776363Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:48922be0ccf04c3798ad41ec21aecf725686555bf49c85022e74eb84a366cf7f","observation_id":"3d999283-7563-4363-a603-ddc2a8712cc4","resolution":{"observed_at":"2026-08-06T18:36:47.776363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16785","last_updated":"2024-05-31T15:03:11Z","snapshot_observed_at":"2026-07-06T17:35:41.168780Z","submitted_at":"2024-02-26T18:00:29Z","title":"CARTE: Pretraining and Transfer for Tabular Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16785","snapshot_observed_at":"2026-08-06T18:36:47.781086Z","title":"J., Grinsztajn, L., and Varoquaux, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.781086Z"},"links":{"cited_paper":"/paper/2402.16785","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:d4eabe5b3dd187412d2faea708f0a981e516d4d535cf4b1c4fdf50e0cd63fc6f","observation_id":"2f229c0d-7b38-45e0-871a-c7df06729364","resolution":{"observed_at":"2026-08-06T18:36:47.781086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11596","last_updated":"2025-02-17T09:28:51Z","snapshot_observed_at":"2026-08-07T18:13:13.120361Z","submitted_at":"2025-02-17T09:28:51Z","title":"LLM Embeddings for Deep Learning on Tabular Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11596","snapshot_observed_at":"2026-08-06T18:36:47.785860Z","title":"Llm embeddings for deep learning on tabular data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.785860Z"},"links":{"cited_paper":"/paper/2502.11596","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:ac99d91e610f39c79039406e03273c65e3cb623ea9f7fffc5dc5675bb89c7ff0","observation_id":"4cfe51fd-5639-4fb0-b60c-704ef2f0020a","resolution":{"observed_at":"2026-08-06T18:36:47.785860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04057","last_updated":"2024-07-04T16:57:14Z","snapshot_observed_at":"2026-08-06T10:04:51.925193Z","submitted_at":"2024-07-04T16:57:14Z","title":"TALENT: A Tabular Analytics and Learning Toolbox","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04057","snapshot_observed_at":"2026-08-06T18:36:47.790726Z","title":"Talent: A tabular analytics and learning toolbox","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.790726Z"},"links":{"cited_paper":"/paper/2407.04057","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:6617722461b2f5cbcd1b4cc8b7a2139cfa3c81b309f01a9393b18e5425dfdc0c","observation_id":"f2b6bb55-8deb-414c-8e46-6085c0fd301d","resolution":{"observed_at":"2026-08-06T18:36:47.790726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.796759Z","title":"Mug: A multimodal classification benchmark on game data with tabular, textual, and visual fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.796759Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:aaa2c1a61f90e28c99b73a243640c418afe7fa9f42efb72bbc13dbb0e6aacd35","observation_id":"d212f918-239c-42a2-a6cb-30ab6f33bb59","resolution":{"observed_at":"2026-08-06T18:36:47.796759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.801181Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.801181Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:f1e78a4dc0f0ebfe7f2b6a4ed94c7df9492b591358cf3720f5b9e9d86943d1a2","observation_id":"0e193bd7-f170-4e32-afac-bd6d0fee7595","resolution":{"observed_at":"2026-08-06T18:36:47.801181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.805612Z","title":"C., Golestan, K., Yu, G., Volkovs, M., and Caterini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.805612Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:5c9ee15ec501b8cfd83b5beaa883abaf45593d2f22a2636e5f5380206eb5efec","observation_id":"dd1bc50d-5e66-4035-9d14-95163b290aee","resolution":{"observed_at":"2026-08-06T18:36:47.805612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:47.923586Z","title":"and Ratajczak, W","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.923586Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:86de2786cfdb60280c44d66069aafcb746201b6702ddab9224564d9bdbb09534","observation_id":"de99a1bf-5ee9-4548-b326-cb14bf0be713","resolution":{"observed_at":"2026-08-06T18:36:47.923586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:48.538176Z","title":null,"venue":null,"work_id":"b7d568dc-6846-44a9-9108-b984b2e3e456","year":2023},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.928885Z"},"links":{"citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:ded240aab02dd00da9748d1b0a34f1950d27b722fe193b7bc7ddc4f3dda498d7","observation_id":"b77ceb41-ea15-4e30-a9a0-62a0e3e34b3d","resolution":{"observed_at":"2026-08-06T18:36:48.542595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02997","last_updated":"2024-07-15T19:00:47Z","snapshot_observed_at":"2026-07-06T15:23:21.708631Z","submitted_at":"2023-05-04T17:04:41Z","title":"When Do Neural Nets Outperform Boosted Trees on Tabular Data?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02997","snapshot_observed_at":"2026-08-06T18:36:47.933777Z","title":"P., Feuer, B., Hegde, C., Ramakrishnan, G., Goldblum, M., and White, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.933777Z"},"links":{"cited_paper":"/paper/2305.02997","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:4f1a677b139ddcdd5d852ef6a5346edf904644468997e5af845f04d3d35472ad","observation_id":"3c40f97a-7d09-4260-87f3-95a17bc30202","resolution":{"observed_at":"2026-08-06T18:36:47.933777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02705","last_updated":"2021-11-04T09:29:16Z","snapshot_observed_at":"2026-08-05T03:09:36.676057Z","submitted_at":"2021-11-04T09:29:16Z","title":"Benchmarking Multimodal AutoML for Tabular Data with Text Fields","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02705","snapshot_observed_at":"2026-08-06T18:36:47.938962Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.938962Z"},"links":{"cited_paper":"/paper/2111.02705","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:a1a12c42a0f6c350c51a0be82a4a38a0d887d1139a592f174a23371d74b5f4fc","observation_id":"20f4a16d-b51d-445d-b8e4-85069cf05237","resolution":{"observed_at":"2026-08-06T18:36:47.938962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11877","last_updated":"2025-02-17T15:03:54Z","snapshot_observed_at":"2026-08-07T18:12:12.106664Z","submitted_at":"2025-02-17T15:03:54Z","title":"JoLT: Joint Probabilistic Predictions on Tabular Data Using LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11877","snapshot_observed_at":"2026-08-06T18:36:47.943525Z","title":"A., Gonzalez, J., Duvenaud, D., and Turner, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.943525Z"},"links":{"cited_paper":"/paper/2502.11877","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:f367b93224fc31e2eac0ba9b936479dc8ef96e3c21f480e4510a46f7dad54660","observation_id":"68150fff-f389-4666-be6f-8c868c976331","resolution":{"observed_at":"2026-08-06T18:36:47.943525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16233","last_updated":"2024-04-30T21:09:27Z","snapshot_observed_at":"2026-07-06T18:05:16.683850Z","submitted_at":"2024-04-24T22:28:12Z","title":"AutoGluon-Multimodal (AutoMM): Supercharging Multimodal AutoML with Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16233","snapshot_observed_at":"2026-08-06T18:36:47.948093Z","title":"Autogluon-multimodal (automm): Supercharging multimodal automl with foundation models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.948093Z"},"links":{"cited_paper":"/paper/2404.16233","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:5cac6aaf2b4b9cc92164093b4544b6618fedd1071e68079b238e9396b5c34db9","observation_id":"b7cd1408-79a6-4cfc-98cf-5c62396afbdd","resolution":{"observed_at":"2026-08-06T18:36:47.948093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10957","last_updated":"2020-04-06T02:53:18Z","snapshot_observed_at":"2026-07-06T09:00:01.184557Z","submitted_at":"2020-02-25T15:21:10Z","title":"MiniLM: Deep Self-Attention Distillation for Task-Agnostic Compression of Pre-Trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10957","snapshot_observed_at":"2026-08-06T18:36:47.952726Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.952726Z"},"links":{"cited_paper":"/paper/2002.10957","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:ca1daf3e65f8265ef7f44951878826b9a4493df346f8da3f0267b58beb803fe0","observation_id":"39807671-9e31-42b6-b726-dd81eba8cd87","resolution":{"observed_at":"2026-08-06T18:36:47.952726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19318","last_updated":"2025-02-17T13:45:00Z","snapshot_observed_at":"2026-07-06T17:52:30.328601Z","submitted_at":"2024-03-28T11:21:12Z","title":"TableLLM: Enabling Tabular Data Manipulation by LLMs in Real Office Usage Scenarios","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19318","snapshot_observed_at":"2026-08-06T18:36:47.958225Z","title":"Tablellm: Enabling tabular data manipulation by llms in real office usage scenarios, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:47.958225Z"},"links":{"cited_paper":"/paper/2403.19318","citing_paper":"/paper/2507.07829"},"observation_digest":"sha256:1f040738bbeecfbfc481d046357d0b323aa5476ec44f850edd4613221f26ba9a","observation_id":"df858277-3b94-4495-b64a-1bbc205d457e","resolution":{"observed_at":"2026-08-06T18:36:47.958225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07829","last_updated":"2025-07-10T15:01:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:02:16.058291Z","submitted_at":"2025-07-10T15:01:31Z","title":"Towards Benchmarking Foundation Models for Tabular Data With Text"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 3 inbound Pith citation observations for arXiv:2507.07829."}