{"as_of":"2026-08-08T14:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3476c49af884d277b5f854f567e3f628c8d40f8a7428ee6f23228fa6cf3138a4","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:23:06.727778Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T13:45:07.339338Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:50:11.133540Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2605.19662","last_updated":"2026-06-06T14:55:14Z","snapshot_observed_at":"2026-08-07T20:04:37.345428Z","submitted_at":"2026-05-19T10:55:35Z","title":"When Tabular Foundation Models Meet Strategic Tabular Data: A Prior Alignment Approach","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T05:42:00.584949Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2605.19662"},"observation_digest":"sha256:cd69b571da0c31333d92b6e84d72c01415c7af6ec7efd0e31f67f2cdbb1fc864","observation_id":"34393b24-82ea-43c3-b4be-f9f5cc24ab05","resolution":{"observed_at":"2026-05-20T05:43:05.602844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2606.11473","last_updated":"2026-06-09T22:07:04Z","snapshot_observed_at":"2026-08-08T02:30:58.093252Z","submitted_at":"2026-06-09T22:07:04Z","title":"CRUMB: Efficient Prior Fitted Network Inference via Distributionally Matched Context Batching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T13:45:07.339338Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2606.11473"},"observation_digest":"sha256:96e17797a66f145f43f3e959e2e05b2b0be13c9bc7b8dd4e66c9f77b9f11182d","observation_id":"60aab242-93a3-43d6-857b-e35848b61a19","resolution":{"observed_at":"2026-07-03T04:37:37.352182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2606.24995","last_updated":"2026-06-23T15:52:35Z","snapshot_observed_at":"2026-08-03T10:05:54.978464Z","submitted_at":"2026-06-23T15:52:35Z","title":"Are Tabular Foundation Models Robust to Realistic Query Distribution Shifts in Microbiome Data?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T00:20:45.845889Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2606.24995"},"observation_digest":"sha256:c717d21182f09832af5f312c6e8f43aaa9f4301e6a5897db462e2c50a92b00a9","observation_id":"e66aabdf-dcf3-414c-86a0-bb567e76f823","resolution":{"observed_at":"2026-07-04T16:39:57.987181Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"cited_work":{"arxiv_id":"2506.05584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05584","snapshot_observed_at":"2026-07-04T20:50:11.133540Z","title":"arXiv preprint arXiv:2506.05584 , year=","venue":null,"work_id":"028980ef-8e44-4c13-aaff-0f1525e24c13","year":2025},"citing_paper":{"arxiv_id":"2606.26021","last_updated":"2026-06-24T16:42:21Z","snapshot_observed_at":"2026-08-05T14:48:17.313246Z","submitted_at":"2026-06-24T16:42:21Z","title":"Privacy Vulnerabilities of Attention Layers in Tabular Foundation Models and Protection of High-Risk Queries","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:48.784638Z"},"links":{"cited_paper":"/paper/2506.05584","citing_paper":"/paper/2606.26021"},"observation_digest":"sha256:7aae0d2bcf53004b4c97a89c114f88e9ad548b4cb137936576dafc25f4013b00","observation_id":"6828f47b-8727-4487-a6c9-c15f765c202a","resolution":{"observed_at":"2026-07-04T20:50:11.135822Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05584/citation-record","integrity":"/paper/2506.05584/integrity","json":"/paper/2506.05584/citation-record.json","paper":"/paper/2506.05584"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.065322Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.065322Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:50df4990b51637de1c0ef37aa0df736543b228c5521458aed016b543c98ff989","observation_id":"b817498e-ed5b-4230-b8d1-5c9292dd378e","resolution":{"observed_at":"2026-08-07T10:23:06.065322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T10:23:06.072004Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.072004Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:408601f7a65084ddc0c58cb1e2ee51ed24468934ab0b620b36ea53b3daadb918","observation_id":"93a05e08-61dd-42b9-94ca-697b20e0802e","resolution":{"observed_at":"2026-08-07T10:23:06.072004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.252708Z","title":null,"venue":null,"work_id":"1545b9e1-c6b8-405a-b160-459c88a69d1a","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.077789Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:4e97ff7d779d13ba9fde2215313a1f6c19159c9f0e72cb4b2d427620091ec568","observation_id":"1e4aa804-8985-4516-892d-a5e1a8b7e3a7","resolution":{"observed_at":"2026-08-07T10:23:08.257739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08867","last_updated":"2024-06-24T19:58:06Z","snapshot_observed_at":"2026-08-08T04:56:05.909330Z","submitted_at":"2024-01-16T22:44:12Z","title":"MambaTab: A Plug-and-Play Model for Learning Tabular Data","version":2},"cited_work":{"arxiv_id":"2401.08867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08867","snapshot_observed_at":"2026-08-07T10:23:07.187900Z","title":"MambaTab: A Plug-and-Play Model for Learning Tabular Data","venue":"cs.LG","work_id":"6bc736bc-5081-4b18-b070-38c831d1e2e4","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.082568Z"},"links":{"cited_paper":"/paper/2401.08867","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d6b758f2ccb8357fb351f371b17ba61193e86ca9c5efbf000d45f26ca85f57d4","observation_id":"f68e4c6b-1de3-43c8-a48d-70ed842240ef","resolution":{"observed_at":"2026-08-07T10:23:07.195570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.232845Z","title":"Transformers learn to implement preconditioned gradient descent for in-context learning","venue":null,"work_id":"fbf1728f-57ce-4207-88be-e86b35e46a3b","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.087619Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d2453b08484736d44b86f033a9b9e9a080873655c13136b22f66ed18e4aadb25","observation_id":"041d3fc8-7e9e-4ea7-9497-c9723b7607dd","resolution":{"observed_at":"2026-08-07T10:23:08.238148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.210978Z","title":null,"venue":null,"work_id":"41a37326-7cde-4117-a0fd-11fed35c5a8b","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.095535Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:81ddc311a447a074b05471103e3c37a8267f916f86885d94793972d76f9e2b9c","observation_id":"4a449f67-c86a-4573-a991-8ade9b985dda","resolution":{"observed_at":"2026-08-07T10:23:08.216689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.184068Z","title":"Loan approval prediction based on machine learning approach","venue":null,"work_id":"ed676425-df3f-4da4-a8de-1d84804bd6c3","year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.100926Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7ef3626ebe7b0659a61a983ac4bfb58c9426f6e7cce44565a67bef3cd340493c","observation_id":"8a0c7c64-b24e-4ee6-9274-d7260ba49a49","resolution":{"observed_at":"2026-08-07T10:23:08.190370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T10:23:06.107328Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.107328Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:86fb003e2e109243613b28d267598526d0aff845ac82971f8c5e70609d77dc69","observation_id":"433aeaf1-88fa-44c7-9911-48d489504671","resolution":{"observed_at":"2026-08-07T10:23:06.107328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T10:23:06.112340Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.112340Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d461091aea6e9f7274e7e46dd8153588abe23761b1b49a7b45d3335155d30899","observation_id":"1fdd5875-b8e2-421c-833c-1ff9aa89b60f","resolution":{"observed_at":"2026-08-07T10:23:06.112340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.158743Z","title":"Transformers as statisticians: Provable in-context learning with in-context algorithm selection","venue":null,"work_id":"becf1318-8876-49be-a82e-6e34e2c8ee18","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.117080Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:01b7d8e8b711052b1556390c21b5bc8e94daa497b1123d235f8ad8d3248888f1","observation_id":"1a2cb109-d55e-4a1e-b53b-1775439a0057","resolution":{"observed_at":"2026-08-07T10:23:08.165284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T10:23:06.122150Z","title":"E., and Cohan, A","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.122150Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:b63a070f8f423d277c303d27305a3c5f24ad397dd2ab8b3414b1e3e1212494dc","observation_id":"ab51883f-04e6-499a-831c-4be4e517617a","resolution":{"observed_at":"2026-08-07T10:23:06.122150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.03731","last_updated":"2021-11-22T13:58:04Z","snapshot_observed_at":"2026-07-06T05:55:01.476523Z","submitted_at":"2017-08-11T23:28:48Z","title":"OpenML Benchmarking Suites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.03731","snapshot_observed_at":"2026-08-07T10:23:06.127733Z","title":"G., van Rijn, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.127733Z"},"links":{"cited_paper":"/paper/1708.03731","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:b38b73fef7cb8106fe958a2211dd9f6bdbd4834140243308ca4d5f99d94f2c21","observation_id":"a493816b-54b2-4d86-9808-6e3121e67d7c","resolution":{"observed_at":"2026-08-07T10:23:06.127733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.134855Z","title":"M., Gir \\'o -i Nieto, X., and Ioannidis, A","venue":null,"work_id":"f131c948-2e62-4564-9910-b6f311e4e3e3","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.133303Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:668761c4c7cdef2845f984d8ad91dc027406699a8debb506e578335b1d3bc917","observation_id":"ae5d8beb-3267-4318-b79e-c85702ca208b","resolution":{"observed_at":"2026-08-07T10:23:08.141288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.116902Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":"1db40920-43dd-4ad4-92e9-556893c5ad4e","year":1901},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.137694Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:ed63ff6aeaeecec04465f7a12f54bebae2443d25cc2694c7eb8f43a549f2280b","observation_id":"fcd03941-5e71-49f1-b641-f5ce6e636746","resolution":{"observed_at":"2026-08-07T10:23:08.121938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.098262Z","title":"Z., and Wu, J","venue":null,"work_id":"83fc8c37-b22f-4a2b-9978-11b06af67d03","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.142477Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:20dd4dcf91cee1670f2cc00656240814b0194baad7612b1c6f86524964b5c150","observation_id":"573f1dfe-0055-476a-b5e2-e20ebb091fc4","resolution":{"observed_at":"2026-08-07T10:23:08.103775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.148357Z","title":"and Guestrin, C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.148357Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:fee1afd3185c2fe08e866f898da20f2a2c248a73d03eb32d246023d103245ab1","observation_id":"aef7be51-d6fb-46d8-9600-6ce377f78233","resolution":{"observed_at":"2026-08-07T10:23:06.148357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T10:23:06.153832Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.153832Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:ad20732e9305ef0d85d072d36877139ad0eb680287133ef2048bb63747296214","observation_id":"30b8fd06-a223-4ac6-9356-e0072305eadc","resolution":{"observed_at":"2026-08-07T10:23:06.153832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T10:23:06.159190Z","title":"Qwen2-audio technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.159190Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5e15bed2cf033cc9c168891a79ae6450c491d2588921713568d8fd0e9f175eb8","observation_id":"63bda6d5-3641-48e6-959d-ff85f01e386c","resolution":{"observed_at":"2026-08-07T10:23:06.159190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.066621Z","title":"Support-vector networks","venue":null,"work_id":"86ea5684-6e09-4fea-b6fe-387ea0151d61","year":1995},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.165037Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:c4b3400aa1334dd6ded9dc2a29607096b6dd62051a636a233579d94ef15c0c94","observation_id":"5d724641-74ca-4238-bb5d-156e31e2e8d0","resolution":{"observed_at":"2026-08-07T10:23:08.071545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.170745Z","title":"and Hart, P","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.170745Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:3a2e44c26f782d887b1667d75cb7393c82680fba13ec1ad3d0b8b3476591d652","observation_id":"6faca99f-281f-4e34-bd49-43135fcf1318","resolution":{"observed_at":"2026-08-07T10:23:06.170745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.035167Z","title":null,"venue":null,"work_id":"373ecee4-0d07-4957-ad84-671add068f12","year":1958},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.177392Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:ecedb5c32a1004b68271b535ec74af4ad3175068003cb7df21b7485653dfbd79","observation_id":"9d6b89d4-0766-4767-9090-a8b0e8ea6410","resolution":{"observed_at":"2026-08-07T10:23:08.040098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:08.017677Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"edca073d-7055-4594-a131-4c136ef219c0","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.182377Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:27387e3995bcdf90a7394d62997e1c625838abbdb3a65f83d7a9f84f4c0a112b","observation_id":"8e377e70-ca0d-4d95-aee9-6aa10c4f124b","resolution":{"observed_at":"2026-08-07T10:23:08.024159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.997481Z","title":"and Gu, A","venue":null,"work_id":"03d61442-7b4a-4aac-a2c4-73b478b1cc16","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.187431Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:3474e550bd44c856a4c0ed517988a5c3e85d7581e0e0d83f5df77a6adb659f5c","observation_id":"4c865d6d-a105-411e-a84e-e7e54ab9973e","resolution":{"observed_at":"2026-08-07T10:23:08.003932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.977303Z","title":"Y., Ermon, S., Rudra, A., and Re, C","venue":null,"work_id":"19426d54-6283-4e39-a652-2e12a2de93c6","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.193246Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7473cf19d0117c66986a350d3702baa83c5199fba5d0aa9efbba8dc7aeeb3e61","observation_id":"2e4838aa-ce49-4277-840a-a2ffba4ce608","resolution":{"observed_at":"2026-08-07T10:23:07.982718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.957277Z","title":"CausalLM is not optimal for in-context learning","venue":null,"work_id":"fa2560da-ea87-4306-80cd-e80e4f40e94b","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.198978Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9675b317ca4921eede46bb1e81f2c59dd8d9094755b150ac1a5b9af638d8b8de","observation_id":"a52cff8b-3911-47bd-b4bc-935e47a66946","resolution":{"observed_at":"2026-08-07T10:23:07.962940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.938291Z","title":"LIFT : Language-interfaced fine-tuning for non-language machine learning tasks","venue":null,"work_id":"ddcb2b73-9d4d-4789-9934-9048446fb522","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.203917Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:ee28e47b96df1d8a9884ce02852427d1a92825976104839d6769f8547b1da531","observation_id":"d9efcc46-14b8-4aef-a98c-80730f00f605","resolution":{"observed_at":"2026-08-07T10:23:07.943462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:23:06.209784Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.209784Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7015b89e0fce8620b2177f54141e43bbd5c1e5388f30aa7319b0ca91f2b9df06","observation_id":"01e7eb41-3150-42b5-a12c-068602dcd713","resolution":{"observed_at":"2026-08-07T10:23:06.209784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11137","last_updated":"2024-10-21T16:48:06Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-17T00:02:23Z","title":"TuneTables: Context Optimization for Scalable Prior-Data Fitted Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11137","snapshot_observed_at":"2026-08-07T10:23:06.215110Z","title":"T., Cherepanova, V., Hegde, C., Hutter, F., Goldblum, M., Cohen, N., and White, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.215110Z"},"links":{"cited_paper":"/paper/2402.11137","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:97efdcf87922906c02a0d4946dac7103901aa800f273fbe501289435bd34edd1","observation_id":"481dbd0d-7620-47ff-b17d-08a0e1e323ba","resolution":{"observed_at":"2026-08-07T10:23:06.215110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.04074","last_updated":"2022-10-04T12:18:34Z","snapshot_observed_at":"2026-07-06T09:36:27.785387Z","submitted_at":"2020-07-08T12:41:03Z","title":"Auto-Sklearn 2.0: Hands-free AutoML via Meta-Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.04074","snapshot_observed_at":"2026-08-07T10:23:06.221142Z","title":"Auto-sklearn 2.0: Hands-free automl via meta-learning","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.221142Z"},"links":{"cited_paper":"/paper/2007.04074","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:a53acaa33d0db34f38305be450fb80e021515ac7e45794fb7f25da8d29f92cf5","observation_id":"8693a9bf-9664-41d0-a789-7eab717df857","resolution":{"observed_at":"2026-08-07T10:23:06.221142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.920027Z","title":null,"venue":null,"work_id":"f0e8e789-5d8f-413e-b002-1ef2c806223e","year":2001},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.228132Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:bee8c9bebf1c48b6aedb5ecda6230610d00f93387f9b15ee82f2c1d5d10ac312","observation_id":"e1dbfe7f-8fe7-4618-b242-e79ff5c00e32","resolution":{"observed_at":"2026-08-07T10:23:07.926864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T10:23:06.234238Z","title":"M., Hauth, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.234238Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:b5b5d0e1743d0b5e9268081510e791563fa59a7a6fbbef63ec4d7d37f03f5b9e","observation_id":"e54fbd43-4e49-4442-be52-11539beb207c","resolution":{"observed_at":"2026-08-07T10:23:06.234238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19572","last_updated":"2023-10-30T14:29:41Z","snapshot_observed_at":"2026-07-06T16:40:31.491333Z","submitted_at":"2023-10-30T14:29:41Z","title":"Improving Input-label Mapping with Demonstration Replay for In-context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19572","snapshot_observed_at":"2026-08-07T10:23:06.239553Z","title":"Improving input-label mapping with demonstration replay for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.239553Z"},"links":{"cited_paper":"/paper/2310.19572","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:da78b3996656243e0666abe1f42073392b52ddabbd8b35a302c2e1e864e10ee8","observation_id":"51a8d04a-da06-4925-a6d1-77bc7f94aec8","resolution":{"observed_at":"2026-08-07T10:23:06.239553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.901247Z","title":"Revisiting deep learning models for tabular data","venue":null,"work_id":"3d7896d4-6ab6-4a80-a389-c8c0e45880e8","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.244445Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:81883419eb0827ac7c5bd0a40d7a088c7dda493c5e102f47fb5554a0034d59c2","observation_id":"4591fffa-7787-46dd-a501-9e754b3f0a60","resolution":{"observed_at":"2026-08-07T10:23:07.906082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.881368Z","title":"TabR : Tabular deep learning meets nearest neighbors","venue":null,"work_id":"3c57f30f-cd25-4de0-83b7-aea97299ff5d","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.249101Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:33ffe9c2b350b4360bab6d454760375068cbe68d99f1ce7b32d8f050975984a2","observation_id":"7c66920f-8104-4eb9-9e9a-6c80e6d241d9","resolution":{"observed_at":"2026-08-07T10:23:07.888655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.860721Z","title":"Why do tree-based models still outperform deep learning on typical tabular data? Advances in neural information processing systems, 35: 0 507--520, 2022","venue":null,"work_id":"ff6c2ce4-fec6-49c4-97f9-5cecceba5cf0","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.256485Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7ede8948e2b5c34ab31aef0553ab279e0b46c3947475e3e4b4289b54851ace13","observation_id":"e3a52d4d-5962-424b-981b-eccd87aa0abb","resolution":{"observed_at":"2026-08-07T10:23:07.868025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.261731Z","title":"and Dao, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.261731Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:f209b68f4a691725dc0be68784ead8c489558fee3e843e6fe68f3a9f92f26fbe","observation_id":"9a095128-6dd6-423a-a88b-58e0c279ca7a","resolution":{"observed_at":"2026-08-07T10:23:06.261731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.818266Z","title":"K., Dao, T., Rudra, A., and Re, C","venue":null,"work_id":"c1c1fe84-3140-44bf-b510-0b03a5777666","year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.268460Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:457bf2f0efdc7ed808318a3dd85a09bd9276674176cc94d400197c6d5d5ce3a6","observation_id":"13ae815f-7b58-48dd-becf-8e41f09e42bf","resolution":{"observed_at":"2026-08-07T10:23:07.823972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.797433Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":"dd2545d8-36e4-4f8f-b3b5-722d2a7188ea","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.273506Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:19782d3f67f2e06bc3b1cc6050f0d64a57be4813c724b9aa79df79e4858ca9c0","observation_id":"59a1cbd2-8ca7-4121-b7a6-76ebbc5d8c87","resolution":{"observed_at":"2026-08-07T10:23:07.805233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04247","last_updated":"2017-03-13T04:55:19Z","snapshot_observed_at":"2026-07-06T05:33:25.278531Z","submitted_at":"2017-03-13T04:55:19Z","title":"DeepFM: A Factorization-Machine based Neural Network for CTR Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04247","snapshot_observed_at":"2026-08-07T10:23:06.279107Z","title":"Deepfm: a factorization-machine based neural network for ctr prediction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.279107Z"},"links":{"cited_paper":"/paper/1703.04247","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:96b0fb228f67e769242e685e15b58907749ff1f6dd67011caeccd09e92688338","observation_id":"6e5bfa1c-ff3e-4358-9876-30ece75396a3","resolution":{"observed_at":"2026-08-07T10:23:06.279107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1101/2024.07.01.600583","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.783720Z","title":"J., Oktay, D., Lin, Z., Verkuil, R., Tran, V","venue":null,"work_id":"6cb45a10-06fb-4621-879a-f819ec45e0a5","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.286156Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:29d8f26e30769e7ddc3bbca5953cbb024d6005ee8e5617df135b38448ed858de","observation_id":"6d1d62b0-7a8b-463f-be04-b71f9b1cc222","resolution":{"observed_at":"2026-08-07T10:23:06.789446Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.291394Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.291394Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7281aafda1bd7370e48e19d196ca9e76d617563bd7786d96623fb70c82a561c7","observation_id":"73aabe10-6bcb-4450-902d-a5942e550aab","resolution":{"observed_at":"2026-08-07T10:23:06.291394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.754039Z","title":"Tab PFN : A transformer that solves small tabular classification problems in a second","venue":null,"work_id":"71ee20ba-1184-4172-89f8-eaa377dfc06b","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.296570Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:bb6666c7f40559735039da69944dbad466b60dbeb12149a4ca32260ee4e23754","observation_id":"3834e135-0a79-479a-ac87-6559466e6ae2","resolution":{"observed_at":"2026-08-07T10:23:07.759799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.301650Z","title":"u ller, S., Purucker, L., Krishnakumar, A., K \\","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.301650Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7d7750cfd5afe6afc780e5ad90ff3a5fa36b8a5c6bb1e3e92c6cddf13a81a45e","observation_id":"fbb51f5b-5186-4c38-b7ad-f799a42d73af","resolution":{"observed_at":"2026-08-07T10:23:06.301650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06678","last_updated":"2020-12-11T23:31:23Z","snapshot_observed_at":"2026-07-06T10:23:43.246202Z","submitted_at":"2020-12-11T23:31:23Z","title":"TabTransformer: Tabular Data Modeling Using Contextual Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.06678","snapshot_observed_at":"2026-08-07T10:23:06.307742Z","title":"Tabtransformer: Tabular data modeling using contextual embeddings","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.307742Z"},"links":{"cited_paper":"/paper/2012.06678","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:0888a2ee4b77d574324dce94af57e5d50d24d263a5fc4030c485300a57ce0450","observation_id":"3626d02e-e574-4811-9a6f-aba428c28004","resolution":{"observed_at":"2026-08-07T10:23:06.307742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.712104Z","title":"E., Pollard, T","venue":null,"work_id":"e39e9d11-672f-4bec-8600-8fef48946366","year":2016},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.313021Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:1cf3ec571afc8d44c54311a8a7c96e733f22354fc6eccbad0f4e1ed5c6eff544","observation_id":"c317637a-e02f-4351-a171-ea8f38611ef2","resolution":{"observed_at":"2026-08-07T10:23:07.717638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.317742Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.317742Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:069553c022b30247cf4122bf3ce09b6b61e4afd48fd27ae8f696e10c4cf0d71d","observation_id":"71da2975-5741-445d-b1ec-594e65bfc18f","resolution":{"observed_at":"2026-08-07T10:23:06.317742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.323253Z","title":"Lightgbm: A highly efficient gradient boosting decision tree","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.323253Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:65243fd5ff2b018598ae525f2775e744c70c720169f1527b22258f6c42f6ddae","observation_id":"23c3617f-2e99-4782-807b-bd53d01b16e9","resolution":{"observed_at":"2026-08-07T10:23:06.323253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.328834Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.328834Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2156dabba8f6f0d63ee246b9c6998d895d9804a8907f8493c37a3e8a996054e8","observation_id":"cad481ce-5fda-475d-85f7-fba4d6e71426","resolution":{"observed_at":"2026-08-07T10:23:06.328834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.646811Z","title":"MNIST handwritten digit database","venue":null,"work_id":"085a2057-ffee-468c-a408-daa861a9b81a","year":2010},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.333557Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2e090ae95eb375bb738937300e347afed654175ac096266e0b9cfd85a8ddcc0a","observation_id":"cb288fe6-622b-42b2-a4ef-d4393c09d118","resolution":{"observed_at":"2026-08-07T10:23:07.652484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.627732Z","title":"Classification and regression by randomforest","venue":null,"work_id":"6eef5bcf-f03e-4dd9-9e7f-b662f2b45e45","year":2002},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.338673Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:a6c8ebc71aa45bc23dc3aaf5a04d690a51f4c1ddab853771a67274377f0050d0","observation_id":"16053309-22c6-4f14-b5b8-418e80100c11","resolution":{"observed_at":"2026-08-07T10:23:07.633523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06971","last_updated":"2024-02-10T15:23:45Z","snapshot_observed_at":"2026-07-06T17:28:23.089590Z","submitted_at":"2024-02-10T15:23:45Z","title":"In-Context Data Distillation with TabPFN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06971","snapshot_observed_at":"2026-08-07T10:23:06.343773Z","title":"In-context data distillation with TabPFN","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.343773Z"},"links":{"cited_paper":"/paper/2402.06971","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:dd78607500a307a5d156881fd10ed168e00eb5f9b24a2ec3020d504e5b1ee27b","observation_id":"b16341c9-dd12-4ad8-a4e1-5005572042db","resolution":{"observed_at":"2026-08-07T10:23:06.343773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.609471Z","title":"and Ratajczak, W","venue":null,"work_id":"15033cf0-9bcb-48f1-be9f-900eff45a3ee","year":1993},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.348860Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5cc919ff7f83ffb25461f9f48a85c4ccea47e4f94a6ef739aa3b0a4af9c1dc3b","observation_id":"c5c54713-870f-46cc-9f9c-0bb1dd3a1f1f","resolution":{"observed_at":"2026-08-07T10:23:07.615090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.578692Z","title":"C., Khandagale, S., Valverde, J., C, V","venue":null,"work_id":"161e529b-ac7e-4f7b-974a-ae671c6ca5e6","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.353544Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:2e3aabc2c4ba69dab749aef178f6946a1db2c4ead30341aeb7e81e8cdcd34fb1","observation_id":"eb6b8719-75fa-4fa9-917f-adabdc5a6e6b","resolution":{"observed_at":"2026-08-07T10:23:07.586683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.559805Z","title":"L., Gu, A., Fernando, A., Gulcehre, C., Pascanu, R., and De, S","venue":null,"work_id":"8f928f59-75be-4ee0-90aa-7d76908f10ed","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.358784Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:43a22f748d4f2e5542e4cb9e42ba7cfc777d6fe8c43dfa772b4cbba4e1b7890a","observation_id":"3fba9fa4-bd7a-4fb7-b7d4-feb4bb05d28c","resolution":{"observed_at":"2026-08-07T10:23:07.565353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.539962Z","title":"G., Albalak, A., Arcadinho, S., Biderman, S., Cao, H., Cheng, X., Chung, M","venue":null,"work_id":"3eff027e-cf39-4a6e-a86b-4218a5c8e77d","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.363887Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9574e7df3451c675498ef5559ea1393a95888f5ac2dd20cb8e7dbf367925ee92","observation_id":"6da4a17e-4df7-4f17-b988-e057036203bc","resolution":{"observed_at":"2026-08-07T10:23:07.545810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06312","last_updated":"2019-09-19T13:30:23Z","snapshot_observed_at":"2026-07-06T08:21:35.030482Z","submitted_at":"2019-09-13T16:11:28Z","title":"Neural Oblivious Decision Ensembles for Deep Learning on Tabular Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06312","snapshot_observed_at":"2026-08-07T10:23:06.369435Z","title":"Neural oblivious decision ensembles for deep learning on tabular data","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.369435Z"},"links":{"cited_paper":"/paper/1909.06312","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:c029dae581885ed4dbcd6b35f0f2aca77d21631ee34f01e766cb5d281a624585","observation_id":"75f94ff4-29fc-4434-9c04-7870b162e21d","resolution":{"observed_at":"2026-08-07T10:23:06.369435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.522850Z","title":"V., and Gulin, A","venue":null,"work_id":"028edc6c-b914-4c8d-b342-7744295557b9","year":2018},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.374629Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:13fb9fae07646ac229c3fe6c0f0c3560826a6795f074853c1790e21a12851e90","observation_id":"bf15c6c0-3e7d-412c-89d7-af7c192e0bea","resolution":{"observed_at":"2026-08-07T10:23:07.528435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.506732Z","title":"The devil in linear transformer","venue":null,"work_id":"353387ca-aa8b-4330-b84b-5dc5ccf0da11","year":2022},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.379524Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:279a2e73e712392819ef8059b7963cb6de711bc0ef7c7f81364d4460f37b3a9f","observation_id":"ee9494b4-b132-41c6-9d83-3a0018722efc","resolution":{"observed_at":"2026-08-07T10:23:07.511941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.490042Z","title":null,"venue":null,"work_id":"f655cca2-66a1-48cd-8e09-5f13cf39dfc9","year":1986},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.385248Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:7bb01a929c1a3046e523621ab3bcd56c56f04b0bfac8eac86237f8343f5dccab","observation_id":"2ce90432-6bb4-4522-854e-fa0edcc7db1c","resolution":{"observed_at":"2026-08-07T10:23:07.495025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.390203Z","title":"L., Ma, J., and Fergus, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.390203Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d8dccfb2d6420f4724d4c467b9ec9b718b9e309e8082a9277b61b4753200989e","observation_id":"451a2a0a-a8b2-4054-bf72-9f58786f088a","resolution":{"observed_at":"2026-08-07T10:23:06.390203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.395312Z","title":"E., Hinton, G","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.395312Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:279ab17b4a4eae5133b1ff79d688ece6cd97f8ea703504001ed74aa08b264a99","observation_id":"40fdd05b-516d-4edc-a06d-332ca6f5d0a5","resolution":{"observed_at":"2026-08-07T10:23:06.395312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-07-06T18:44:53.587276Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-07T10:23:06.400087Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.400087Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5937c8fbf2ed73c1103858b4bb86783a02a53d7211e735d0c47cb1b2eec3dee5","observation_id":"43b0cab2-2df8-4ae5-b648-d5c474b9be60","resolution":{"observed_at":"2026-08-07T10:23:06.400087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01342","last_updated":"2021-06-02T17:51:05Z","snapshot_observed_at":"2026-08-05T11:00:48.512556Z","submitted_at":"2021-06-02T17:51:05Z","title":"SAINT: Improved Neural Networks for Tabular Data via Row Attention and Contrastive Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01342","snapshot_observed_at":"2026-08-07T10:23:06.405863Z","title":"B., and Goldstein, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.405863Z"},"links":{"cited_paper":"/paper/2106.01342","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:c0fcea9909f56a964c6122749ec90da169b06ef575831d55e58ed6628dfb5695","observation_id":"8258b155-2756-43ea-882c-914cdcad3fa8","resolution":{"observed_at":"2026-08-07T10:23:06.405863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-07T10:23:06.410758Z","title":"Retentive network: A successor to transformer for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.410758Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:74bf42e4d544060d2bbd1041fb877a315a01b7f0f9e8b2ff555968b7275f014f","observation_id":"abc6012f-7f4f-46b4-bcf4-74a9abdde51a","resolution":{"observed_at":"2026-08-07T10:23:06.410758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06291","last_updated":"2025-03-25T17:27:53Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:57:57Z","title":"Mambular: A Sequential Model for Tabular Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06291","snapshot_observed_at":"2026-08-07T10:23:06.415765Z","title":"F., Kumar, M., Weisser, C., Reuter, A., S \\\"a fken, B., and Samiee, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.415765Z"},"links":{"cited_paper":"/paper/2408.06291","citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:1d3f5da496f808c6f8682e0c58ccd2f5eb607bf6cd45e15aa130b6d733801d30","observation_id":"92a994ef-569a-40aa-8bfd-6d27c2e28a0c","resolution":{"observed_at":"2026-08-07T10:23:06.415765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.459532Z","title":null,"venue":null,"work_id":"08e4b4dd-0a55-4c15-b92f-083cb1594cad","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.421217Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:926cda4b484ecb4cd2d3a129680fd635421430792a0d1547a3c0ab68763e280d","observation_id":"112d6863-f566-4844-9f6b-ae5b7f216029","resolution":{"observed_at":"2026-08-07T10:23:07.465497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.439378Z","title":"N., Bischl, B., and Torgo, L","venue":null,"work_id":"7c6c3c3f-22a6-48c8-b324-b4bbce5df34b","year":2013},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.426182Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:1f82bfabed0b041c3b4cc85b8e5783e68d28c55e63a62a357d8b9b0f309d0a76","observation_id":"e2affd65-1df2-4f9a-b157-cf39c9268ed7","resolution":{"observed_at":"2026-08-07T10:23:07.445740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.432802Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.432802Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9086d36a1b62839eed5de2e326c865a55ad2c216a33a35d9afddab231d2a09f1","observation_id":"14db07af-519a-40e5-8bb5-99ce5109c05b","resolution":{"observed_at":"2026-08-07T10:23:06.432802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.410608Z","title":null,"venue":null,"work_id":"17539acf-950c-4cb3-a76d-8ba6de355402","year":2005},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.441329Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:fa8aa0b4424e7cd2d3fdb0282c082fb58dc37eb689995cae1ab28608c74bdad7","observation_id":"d75804d2-7baf-4656-8433-59e25f645e1f","resolution":{"observed_at":"2026-08-07T10:23:07.415238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.394408Z","title":"Eegformer: A transformer--based brain activity classification method using eeg signal","venue":null,"work_id":"885b9b56-db61-455e-a404-0bf700803cc0","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.451454Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:d9d83485ff63c2f96a2e093b62adedd5f866b35a615c254ce3b221bf31b2119c","observation_id":"625d2afb-eb06-4c81-a4f5-14a1ff045cb6","resolution":{"observed_at":"2026-08-07T10:23:07.399415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.377336Z","title":"Fashion-MNIST : a novel image dataset for benchmarking machine learning algorithms","venue":null,"work_id":"088fddeb-b5bb-4a5d-bdcc-84a3cd8ffe42","year":2017},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.464061Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:67fedd8fb789ee497eba81c39c0cc42ef622b8f6e64347933c4acc02c8b233e8","observation_id":"79e79d2e-ed20-414b-b1c9-fa718283599e","resolution":{"observed_at":"2026-08-07T10:23:07.381834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.362239Z","title":"Y.-C., Li, W., Gilani, A., Goan, H.-S., and Liu, H","venue":null,"work_id":"a572c023-4e62-4392-b0e8-fa95da6bdb3f","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.475996Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:e503249d6260bd68c0c41658728bbc8fb3c87b545ca0f9c7a7af5550d8ea7a88","observation_id":"0f25105e-9902-4133-bb44-3535ad9565f1","resolution":{"observed_at":"2026-08-07T10:23:07.366521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.344276Z","title":"Q., Cirik, F","venue":null,"work_id":"0b9244e2-3436-472f-bb28-cd1d74676887","year":2025},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.489740Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:0cf4f810548f78d92484a862a800383b086d62a24c56f6c9173495ad9d2ed835","observation_id":"c7cddad3-3e38-40ac-88fc-29525964ec0d","resolution":{"observed_at":"2026-08-07T10:23:07.349787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.325596Z","title":"Feature selection using stochastic gates","venue":null,"work_id":"a14f38c6-9b10-4d10-b55a-3381ed934bfb","year":2020},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.506911Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:5a081fac62dd69af7222a50a62ec66f051d25a2722c56439cdf09a7a1b7b09cd","observation_id":"a92b5bf7-a65b-4f12-b9ca-b4fb6aa0751d","resolution":{"observed_at":"2026-08-07T10:23:07.330645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.308723Z","title":"Gated linear attention transformers with hardware-efficient training","venue":null,"work_id":"017282e1-f00f-4f8f-a1de-e50ab9d679ac","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.518832Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:44faba23eb57486d67d515db7c30b1a94ae0bd09d5233bfd1d2501ad7b569776","observation_id":"73eec504-33ec-4a0b-bee6-cd1dec16467a","resolution":{"observed_at":"2026-08-07T10:23:07.313966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.293389Z","title":"Vime: Extending the success of self-and semi-supervised learning to tabular domain","venue":null,"work_id":"f52ed577-9086-4481-a21c-0e4d9b8406e7","year":2020},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.530629Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9e1068a3df71726823b7a17965291d291354b5609fdea26d40c1492cc89c2843","observation_id":"8df86a36-8313-4643-bf26-2f9619731622","resolution":{"observed_at":"2026-08-07T10:23:07.297874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.277361Z","title":null,"venue":null,"work_id":"1a1dcf8e-0c00-458e-be01-4dd784b3a7a8","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.543485Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:edfb7eb03213c57d0b24fbab010ad7dd873d044c2cabe8622a0f0ad83924d978","observation_id":"b4bd4ff5-8722-439a-b694-2d4805ecb7c0","resolution":{"observed_at":"2026-08-07T10:23:07.282228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.262248Z","title":"The hedgehog & the porcupine: Expressive linear attentions with softmax mimicry","venue":null,"work_id":"7e641ce9-dae2-401f-89d1-fefb2584c49d","year":2024},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.556565Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:057e5c175ef0323478f51ec8327769baf3a3797c26ba8e4b6fb0cdb6b90ce143","observation_id":"4259621e-f1c1-4681-95da-02c55bf42fd3","resolution":{"observed_at":"2026-08-07T10:23:07.266971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:06.651633Z","title":"Deep learning based recommender system: A survey and new perspectives","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.651633Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:b993d03d484a347b4f6892874c4bc9b5d2fbcc9721daa675d4bb7d4a8a5ed2c4","observation_id":"851882f0-af1c-41ae-baef-e3a12d939cf7","resolution":{"observed_at":"2026-08-07T10:23:06.651633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:23:07.234870Z","title":"XTab : Cross-table pretraining for tabular transformers","venue":null,"work_id":"347d09ad-4945-471c-983f-10c532325447","year":2023},"citing_paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T10:23:06.727778Z"},"links":{"citing_paper":"/paper/2506.05584"},"observation_digest":"sha256:9d5efc20ecc55d865ab2bd89ee9ba48da87da188a98eb9f7ec4f34f0b37bc142","observation_id":"fad94aba-f9ae-4341-8b24-58d3251da413","resolution":{"observed_at":"2026-08-07T10:23:07.239628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05584","last_updated":"2025-06-05T20:59:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T04:55:43.591413Z","submitted_at":"2025-06-05T20:59:33Z","title":"TabFlex: Scaling Tabular Learning to Millions with Linear Attention"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 4 inbound Pith citation observations for arXiv:2506.05584."}