{"as_of":"2026-08-05T23:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:329f140b0b135c3eca142c7be162d5d97b5d1e21a1d28c00469cc43e067fd1cb","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:21:33.792875Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.14200/citation-record","integrity":"/paper/2602.14200/integrity","json":"/paper/2602.14200/citation-record.json","paper":"/paper/2602.14200"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-02T23:21:32.032061Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.arXiv preprint arXiv:2312.00752,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:32.032061Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:5bf04d01c49889dd18794a8d211de2a7b258b2e1f12770fb7ebb5897f6a26911","observation_id":"f6e35d26-f5a5-4663-9990-cb3a8eacbf8d","resolution":{"observed_at":"2026-08-02T23:21:32.032061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01728","last_updated":"2024-01-29T06:27:53Z","snapshot_observed_at":"2026-08-04T04:31:27.172482Z","submitted_at":"2023-10-03T01:31:25Z","title":"Time-LLM: Time Series Forecasting by Reprogramming Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01728","snapshot_observed_at":"2026-08-02T23:21:32.114578Z","title":"Greg Kamradt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:32.114578Z"},"links":{"cited_paper":"/paper/2310.01728","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:9ce482c5c328215cc5ec33b2684a1c621d25b39924241a0902339571f83fe42e","observation_id":"ff08d5b8-8386-4c1c-bcda-32aa23461964","resolution":{"observed_at":"2026-08-02T23:21:32.114578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:32.317144Z","title":"OpenTSLM: Time-series language models for reasoning over multivariate medical text- and time-series data.arXiv preprint arXiv:2510.02410,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:32.317144Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:43d5d71c520265067d0746c901a9a6cf82f467d1860e9c19183a28afc46651ff","observation_id":"a90d04dd-6e7f-45ff-89ba-3efef0ffa91e","resolution":{"observed_at":"2026-08-02T23:21:32.317144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.792875Z","title":"Answer: <your answer>","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.792875Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:5934bff32d31e703c2e69b67213cde7b3c653d6c0f8a997279585ca848d0d8d8","observation_id":"6ebfac6f-2adf-43c1-b359-ce24dc68ec14","resolution":{"observed_at":"2026-08-02T23:21:33.792875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.668082Z","title":"These annotations support training and evaluation of reasoning capabilities beyond direct answer extraction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.668082Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:8ce041ce5d4798f684e23fb048709d1aa27ab3fb6745339a42733f84ba5b7301","observation_id":"68050259-8d4e-433c-a576-9a40e7355167","resolution":{"observed_at":"2026-08-02T23:21:33.668082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.286639Z","title":"Their benchmark evaluates five tasks: forecasting, classification, anomaly detection, and imputation, with emphasis on limited supervision settings","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.286639Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:0f04592fbd292338eb69c786fc756a2d9bcf9b5cacede853cce019ce4b47cd38","observation_id":"d376a4f4-3614-4ad4-acb0-2f5ddf8c3785","resolution":{"observed_at":"2026-08-02T23:21:33.286639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.388406Z","title":"Their TSQA dataset comprises approximately 200k question-answer pairs across diverse domains","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.388406Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:508a917eee7ce08ce97449815421856b8a834dd6bc9c1b1057365b65afb60be6","observation_id":"91b75c10-876d-4bdf-a5c5-ae9af584d15f","resolution":{"observed_at":"2026-08-02T23:21:33.388406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.531172Z","title":"02:34:56:789 AM","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.531172Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:808f765cbbda873c989e4da32a79520ea31bd6ba94f3e0bb4b8aec07f1c5ca8a","observation_id":"853ea64f-86cf-49c6-8be3-d9b5b46b7a58","resolution":{"observed_at":"2026-08-02T23:21:33.531172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.177141Z","title":"Random” indicates uniform subsampling to the budget cap; “full","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":151,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.177141Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:c8389b4ebb78390246c44ad76118c6dfdd9c78f6fd1301c06c1c1ecd98b9166b","observation_id":"2ee1a13d-da36-4745-9eb0-174ef41ddc0b","resolution":{"observed_at":"2026-08-02T23:21:33.177141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14752","last_updated":"2024-10-18T02:37:14Z","snapshot_observed_at":"2026-07-06T19:36:10.759412Z","submitted_at":"2024-10-18T02:37:14Z","title":"TimeSeriesExam: A time series understanding exam","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14752","snapshot_observed_at":"2026-08-02T23:21:31.709054Z","title":"Yifu Cai, Arjun Choudhry, Xing Hu, and Artur Dubrawski","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:31.709054Z"},"links":{"cited_paper":"/paper/2410.14752","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:439267154d28c01321bfd68dd3454e8dab2524a06e3cf6dd2c30f9091c82674e","observation_id":"da0c4c6b-93ac-49ec-9e0e-efd8479606f3","resolution":{"observed_at":"2026-08-02T23:21:31.709054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11230","last_updated":"2025-02-11T02:17:24Z","snapshot_observed_at":"2026-07-06T18:31:57.866202Z","submitted_at":"2024-06-17T05:54:06Z","title":"Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11230","snapshot_observed_at":"2026-08-02T23:21:32.745298Z","title":"Multimodal needle in a haystack: Benchmarking long-context capability of multimodal large language models.arXiv preprint arXiv:2406.11230,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:32.745298Z"},"links":{"cited_paper":"/paper/2406.11230","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:7676d318cfd24e989c90fa38dddb943c5061807c3c700e3a1db40fad9c88d969","observation_id":"94e88e0f-9735-4b2b-bfab-e730f6bd0fdf","resolution":{"observed_at":"2026-08-02T23:21:32.745298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:21:33.047086Z","title":"A CLASSIFICATIONEXPERIMENTDETAILS A.1 EXPERIMENTALSETUP Model architecture.We use the Flamingo variant of OpenTSLM (Langer et al.,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:33.047086Z"},"links":{"citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:f1664f60606830d07615666ae2d70eef1a4f06036d67f856582625d2fc5768f9","observation_id":"82a771da-cb53-4e2b-9eb7-bcc6bda9766e","resolution":{"observed_at":"2026-08-02T23:21:33.047086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T23:21:32.570892Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:32.570892Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:58d1a5cc1c7cac971e766a39214037eeedb8cc4b8489f7baa15c4f825ef310dc","observation_id":"bbc2b0ce-27ad-4083-84ad-9f945449bf44","resolution":{"observed_at":"2026-08-02T23:21:32.570892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T23:21:31.882313Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:31.882313Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:30339a176b9706da51bbc42b4d97921bc960b61b1ef9ebf2062b0232ed3735d0","observation_id":"f49f33e6-ef1c-4899-b652-8b762eddd68a","resolution":{"observed_at":"2026-08-02T23:21:31.882313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20093","last_updated":"2025-06-25T02:33:47Z","snapshot_observed_at":"2026-07-06T21:47:15.902527Z","submitted_at":"2025-06-25T02:33:47Z","title":"ITFormer: Bridging Time Series and Natural Language for Multi-Modal QA with Large-Scale Multitask Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20093","snapshot_observed_at":"2026-08-02T23:21:32.958348Z","title":"Matthew Willetts, Sven Hollowell, Louis Aslett, Chris Holmes, and Aiden Doherty","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning","version":6},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T23:21:32.958348Z"},"links":{"cited_paper":"/paper/2506.20093","citing_paper":"/paper/2602.14200"},"observation_digest":"sha256:06b8385cc0b340543a7e6d5ea5fe9bc66f9613bd57e56ca74b132603ae528c0a","observation_id":"71647806-738d-43da-bbdd-549690ea3a6f","resolution":{"observed_at":"2026-08-02T23:21:32.958348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.14200","last_updated":"2026-06-30T15:10:55Z","latest_version":6,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T23:21:30.159893Z","submitted_at":"2026-02-15T15:50:02Z","title":"TS-Haystack: A Multi-Task Retrieval Benchmark for Long-Context Time-Series Reasoning"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2602.14200."}