{"as_of":"2026-08-08T18:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:634b96e458b143c742f70230b354aac1c5cafa2c98367a740bd5bef307b9c5da","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:40:15.258282Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T13:24:32.231221Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":"2205.12035","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shitao Xiao, Zheng Liu, Peitian Zhang, Niklas Muen- nighoff, Defu Lian, and Jian-Yun Nie","venue":null,"work_id":"6ceff5f4-677d-459b-a1ba-088e92825ffc","year":2022},"citing_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T13:24:32.084878Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2309.07597"},"observation_digest":"sha256:528a0611165e72cd050017f07397817b7910765bde37ec1ca2213c650f393981","observation_id":"4dddbca4-c7a1-4f1a-86f3-792ac3f48ce7","resolution":{"observed_at":"2026-05-13T13:24:32.234471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-08-08T17:40:15.258282Z","title":"Brian W Matthews","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05878","last_updated":"2025-06-07T00:43:58Z","snapshot_observed_at":"2026-08-08T17:32:07.533193Z","submitted_at":"2025-02-09T12:26:05Z","title":"Retrieval-augmented Large Language Models for Financial Time Series Forecasting","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T17:40:15.258282Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2502.05878"},"observation_digest":"sha256:9f238baee151a29f40b08a3fe636db88594eec14688266b096d339961d6550cd","observation_id":"24c5a142-92d8-428e-882b-a9e6443318ef","resolution":{"observed_at":"2026-08-08T17:40:15.258282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-08-06T22:23:07.685801Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21913","last_updated":"2025-06-27T04:57:01Z","snapshot_observed_at":"2026-08-06T22:13:31.684860Z","submitted_at":"2025-06-27T04:57:01Z","title":"HyReC: Exploring Hybrid-based Retriever for Chinese","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T22:23:07.685801Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2506.21913"},"observation_digest":"sha256:e9e93b31a18f0d784b1b50f98c75c906599fa86f18834eb457e773e17cf5dd2d","observation_id":"5f2131ff-d839-4823-879b-8d202e038a3c","resolution":{"observed_at":"2026-08-06T22:23:07.685801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-08-06T20:02:17.559134Z","title":"arXiv preprint arXiv:2205.12035 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03958","last_updated":"2025-08-06T08:11:23Z","snapshot_observed_at":"2026-08-08T11:20:02.798729Z","submitted_at":"2025-07-05T08:50:29Z","title":"A Comparative Study of Specialized LLMs as Dense Retrievers","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:17.559134Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2507.03958"},"observation_digest":"sha256:e7f25d1dbba23958f9196762f6baf667cbea939951e730308ff1ce1f3c5d2300","observation_id":"603beeba-0ff1-42ae-8345-fc056fe0308c","resolution":{"observed_at":"2026-08-06T20:02:17.559134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-08-06T17:30:00.412279Z","title":"Retromae: Pre-training retrieval- oriented language models via masked auto-encoder,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10873","last_updated":"2025-07-15T00:24:53Z","snapshot_observed_at":"2026-08-06T17:20:32.104586Z","submitted_at":"2025-07-15T00:24:53Z","title":"From Alerts to Intelligence: A Novel LLM-Aided Framework for Host-based Intrusion Detection","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T17:30:00.412279Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2507.10873"},"observation_digest":"sha256:6ad9b33d3898796bec07b08649921c580dedc53debffad40256527b9e84fe06e","observation_id":"99832e11-fd86-4a71-8ce3-a65a9c4bb9ca","resolution":{"observed_at":"2026-08-06T17:30:00.412279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-07-13T09:07:18.453118Z","title":"Retromae: Pre-training retrieval-oriented language models via masked auto-encoder.arXiv preprint arXiv:2205.12035,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.06162","last_updated":"2026-06-29T11:06:50Z","snapshot_observed_at":"2026-08-04T14:27:04.524743Z","submitted_at":"2026-04-07T17:56:22Z","title":"Mutual Linearity in and out of Stationarity for Markov Jump Processes: A Trajectory-Based Approach","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T09:07:18.453118Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2604.06162"},"observation_digest":"sha256:72773ee4339c013d65731aa7e1df0c972b3747a5af25dea6ca688f050e25e5ff","observation_id":"eb74fcb4-b788-4f84-bc37-cede79d2a900","resolution":{"observed_at":"2026-07-13T09:07:18.453118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":"2205.12035","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shitao Xiao, Zheng Liu, Peitian Zhang, Niklas Muen- nighoff, Defu Lian, and Jian-Yun Nie","venue":null,"work_id":"6ceff5f4-677d-459b-a1ba-088e92825ffc","year":2022},"citing_paper":{"arxiv_id":"2604.06163","last_updated":"2026-04-07T17:57:07Z","snapshot_observed_at":"2026-07-06T22:54:44.656835Z","submitted_at":"2026-04-07T17:57:07Z","title":"Data, Not Model: Explaining Bias toward LLM Texts in Neural Retrievers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:13.270040Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2604.06163"},"observation_digest":"sha256:a03699883351577575d2fee6b59be7a01389390812a976295992d8f6ccd7e09d","observation_id":"95b4967d-2c73-4c4e-b9f2-10db54b76d48","resolution":{"observed_at":"2026-05-11T00:41:04.985020Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":"2205.12035","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shitao Xiao, Zheng Liu, Peitian Zhang, Niklas Muen- nighoff, Defu Lian, and Jian-Yun Nie","venue":null,"work_id":"6ceff5f4-677d-459b-a1ba-088e92825ffc","year":2022},"citing_paper":{"arxiv_id":"2604.10937","last_updated":"2026-04-20T03:33:53Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T03:14:31Z","title":"Benchmarking and Enabling Efficient Chinese Medical Retrieval via Asymmetric Encoders","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:38:29.326644Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2604.10937"},"observation_digest":"sha256:f1089c6f37907ea8eed183816e16a5916e0529a717e07494e934d541d262adcf","observation_id":"edecf1f7-534b-45bb-a32f-9247d279ab7e","resolution":{"observed_at":"2026-05-11T08:26:01.004719Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":"2205.12035","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shitao Xiao, Zheng Liu, Peitian Zhang, Niklas Muen- nighoff, Defu Lian, and Jian-Yun Nie","venue":null,"work_id":"6ceff5f4-677d-459b-a1ba-088e92825ffc","year":2022},"citing_paper":{"arxiv_id":"2604.27037","last_updated":"2026-04-29T17:05:53Z","snapshot_observed_at":"2026-07-06T23:12:33.898150Z","submitted_at":"2026-04-29T17:05:53Z","title":"Hypencoder Revisited: Reproducibility and Analysis of Non-Linear Scoring for First-Stage Retrieval","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-07T11:17:31.742114Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2604.27037"},"observation_digest":"sha256:0be7a856af1247e6330896bac25ea18200a13c4c12c4bad0b750f90248dfc715","observation_id":"695bbdce-4f8a-4cd0-aa37-8ac0b290d1f6","resolution":{"observed_at":"2026-05-12T09:21:25.976863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12035","snapshot_observed_at":"2026-07-11T22:20:52.422988Z","title":"arXiv preprint arXiv:2205.12035 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04011","last_updated":"2026-07-04T20:13:38Z","snapshot_observed_at":"2026-08-06T03:55:35.624754Z","submitted_at":"2026-07-04T20:13:38Z","title":"Separating Representation from Reconstruction Enables Scalable Text Encoders","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-11T22:20:52.422988Z"},"links":{"cited_paper":"/paper/2205.12035","citing_paper":"/paper/2607.04011"},"observation_digest":"sha256:3978826f0bb153362d311b3f91c12507b42be15f04412a95ad3cba129a002d78","observation_id":"53857998-f47c-40b9-bfa8-8b1c804b38c0","resolution":{"observed_at":"2026-07-11T22:20:52.422988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2205.12035/citation-record","integrity":"/paper/2205.12035/integrity","json":"/paper/2205.12035/citation-record.json","paper":"/paper/2205.12035"},"outbound":[],"paper":{"arxiv_id":"2205.12035","last_updated":"2022-10-17T14:08:37Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T13:13:22.359120Z","submitted_at":"2022-05-24T12:43:04Z","title":"RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2205.12035."}