{"as_of":"2026-08-08T15:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbee0ac462b92dad5093d3b81f6f9446fb62bf9e70e0ddb9f0ff4d1bd730f060","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:48:01.889809Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":"2310.08232","doi":"10.48550/arxiv.2310.08232","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language models are universal embedders","venue":"arXiv (Cornell University)","work_id":"5221494d-ae34-4d76-b722-2bf1e25e17c8","year":2023},"citing_paper":{"arxiv_id":"2401.03563","last_updated":"2024-01-07T18:12:20Z","snapshot_observed_at":"2026-07-06T17:12:30.312141Z","submitted_at":"2024-01-07T18:12:20Z","title":"Data-CUBE: Data Curriculum for Instruction-based Sentence Representation Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-24T04:29:05.113230Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2401.03563"},"observation_digest":"sha256:df556f16f243a295134dffe8fc4b9713264a95540a4ff80b690d844648273e4c","observation_id":"d2a476cd-ade0-43e7-94d6-2761c7ac8f63","resolution":{"observed_at":"2026-05-24T04:33:53.645931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-07T13:48:01.889809Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20976","last_updated":"2025-05-27T10:07:54Z","snapshot_observed_at":"2026-08-08T06:44:56.801318Z","submitted_at":"2025-05-27T10:07:54Z","title":"Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:48:01.889809Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2505.20976"},"observation_digest":"sha256:db494c4fbf9d71f2438266f1ae2b931338ff0e0deab01580d4526086b7640f96","observation_id":"b8d4e2f2-f7fe-49f0-8aba-ce439538dab1","resolution":{"observed_at":"2026-08-07T13:48:01.889809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-07T12:35:29.530957Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24581","last_updated":"2025-05-30T13:29:03Z","snapshot_observed_at":"2026-08-08T04:58:02.457770Z","submitted_at":"2025-05-30T13:29:03Z","title":"GATE: General Arabic Text Embedding for Enhanced Semantic Textual Similarity with Matryoshka Representation Learning and Hybrid Loss Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:29.530957Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2505.24581"},"observation_digest":"sha256:5a1d0f64e2b281473419ddbe0399d1091679d0a04b4dd74b5384043c9fdf0baf","observation_id":"0278ade8-7992-4456-aca6-2b4ac33e8f70","resolution":{"observed_at":"2026-08-07T12:35:29.530957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-07T05:18:33.823315Z","title":"Zhang, X., Li, Z., Zhang, Y ., Long, D., Xie, P., Zhang, M., and Zhang, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08354","last_updated":"2026-05-28T08:13:47Z","snapshot_observed_at":"2026-08-07T05:10:51.150588Z","submitted_at":"2025-06-10T02:11:42Z","title":"Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning","version":2},"reference_index":125,"source":"pdf_text","source_observed_at":"2026-08-07T05:18:33.823315Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2506.08354"},"observation_digest":"sha256:c30cb7bb8ae5373bfe3d588f44cf0acdf6365f2a2e73fd47792f37de9c179e40","observation_id":"9ee9f992-0319-452f-9318-4926fb7c705f","resolution":{"observed_at":"2026-08-07T05:18:33.823315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":"2310.08232","doi":"10.48550/arxiv.2310.08232","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language models are universal embedders","venue":"arXiv (Cornell University)","work_id":"5221494d-ae34-4d76-b722-2bf1e25e17c8","year":2023},"citing_paper":{"arxiv_id":"2507.23386","last_updated":"2026-05-02T08:43:04Z","snapshot_observed_at":"2026-08-03T20:35:59.300261Z","submitted_at":"2025-07-31T10:01:11Z","title":"Causal2Vec: Improving Decoder-only LLMs as Embedding Models through a Contextual Token","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T02:19:20.792488Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2507.23386"},"observation_digest":"sha256:7359eafa2953bde08b2aa9c70ad9cdaa5fc8d72bba97c4d649f4780c8c611002","observation_id":"7d764506-9809-4df9-b08c-d063559ac7a6","resolution":{"observed_at":"2026-05-19T02:21:59.269987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-05T23:06:49.731775Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-08T09:51:41.415322Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.731775Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:877dd1b9aeb60a4df15e77481826f75d1174cf284b23723dedaddda47f7f92b7","observation_id":"15701eec-a68a-4602-bb80-7ceeb2824b31","resolution":{"observed_at":"2026-08-05T23:06:49.731775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-05T13:16:26.851241Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00842","last_updated":"2025-08-31T13:24:48Z","snapshot_observed_at":"2026-08-08T06:04:08.860997Z","submitted_at":"2025-08-31T13:24:48Z","title":"Negative Matters: Multi-Granularity Hard-Negative Synthesis and Anchor-Token-Aware Pooling for Enhanced Text Embeddings","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T13:16:26.851241Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2509.00842"},"observation_digest":"sha256:eee0d122d8422f4394090105ae5d85db03326821d6a3425f9932a540e8d10b6c","observation_id":"51d59568-163a-4516-baa9-9ed13413b0fa","resolution":{"observed_at":"2026-08-05T13:16:26.851241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":"2310.08232","doi":"10.48550/arxiv.2310.08232","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language models are universal embedders","venue":"arXiv (Cornell University)","work_id":"5221494d-ae34-4d76-b722-2bf1e25e17c8","year":2023},"citing_paper":{"arxiv_id":"2605.01372","last_updated":"2026-05-02T10:31:01Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T10:31:01Z","title":"Embedding-based In-Context Prompt Training for Enhancing LLMs as Text Encoders","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-09T15:03:33.323423Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2605.01372"},"observation_digest":"sha256:12d11946ecc4a3fa7667dea1ef74f60a3a8cf695fcb7ea649e40e21ef84a433b","observation_id":"3bdb5ebd-9b76-4ef6-880b-4620ec3a7171","resolution":{"observed_at":"2026-05-11T16:46:14.936176Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2310.08232/citation-record","integrity":"/paper/2310.08232/integrity","json":"/paper/2310.08232/citation-record.json","paper":"/paper/2310.08232"},"outbound":[],"paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T16:31:48.246401Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2310.08232."}