{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:236RC4Y3T6CX4HYXS6PEU23YAT","short_pith_number":"pith:236RC4Y3","schema_version":"1.0","canonical_sha256":"d6fd11731b9f857e1f17979e4a6b7804d549400c99b0263736946e5c34c0b542","source":{"kind":"arxiv","id":"2502.07972","version":3},"attestation_state":"computed","paper":{"title":"Training Sparse Mixture Of Experts Text Embedding Models","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI","cs.IR"],"primary_cat":"cs.CL","authors_text":"Brandon Duderstadt, Zach Nussbaum","submitted_at":"2025-02-11T21:36:31Z","abstract_excerpt":"Transformer-based text embedding models have improved their performance on benchmarks like MIRACL and BEIR by increasing their parameter counts. However, this scaling approach introduces significant deployment challenges, including increased inference latency and memory usage. These challenges are particularly severe in retrieval-augmented generation (RAG) applications, where large models' increased memory requirements constrain dataset ingestion capacity, and their higher latency directly impacts query-time performance. While causal language models have addressed similar efficiency challenges"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.07972","kind":"arxiv","version":3},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2025-02-11T21:36:31Z","cross_cats_sorted":["cs.AI","cs.IR"],"title_canon_sha256":"59b0ab7a2a336cf18f5c81d0d1ad19f86a4dd011921dabb715928ba242bb1eec","abstract_canon_sha256":"549d2d9570cb98afb6ce0ba3782ef9867841ea2fcb6fa231667b699d2b510047"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:27:24.968149Z","signature_b64":"oV5MzAtQAkB47dY+U2UTObnScOwUoUPWj5Tl/5qsAvTAHOUBqSX0E3AIynf9ue+iFDBgHoXQxmqp6PAbRdsRAg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"d6fd11731b9f857e1f17979e4a6b7804d549400c99b0263736946e5c34c0b542","last_reissued_at":"2026-07-05T10:27:24.967665Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:27:24.967665Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Training Sparse Mixture Of Experts Text Embedding Models","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI","cs.IR"],"primary_cat":"cs.CL","authors_text":"Brandon Duderstadt, Zach Nussbaum","submitted_at":"2025-02-11T21:36:31Z","abstract_excerpt":"Transformer-based text embedding models have improved their performance on benchmarks like MIRACL and BEIR by increasing their parameter counts. However, this scaling approach introduces significant deployment challenges, including increased inference latency and memory usage. These challenges are particularly severe in retrieval-augmented generation (RAG) applications, where large models' increased memory requirements constrain dataset ingestion capacity, and their higher latency directly impacts query-time performance. While causal language models have addressed similar efficiency challenges"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.07972","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.07972/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.07972","created_at":"2026-07-05T10:27:24.967721+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.07972v3","created_at":"2026-07-05T10:27:24.967721+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.07972","created_at":"2026-07-05T10:27:24.967721+00:00"},{"alias_kind":"pith_short_12","alias_value":"236RC4Y3T6CX","created_at":"2026-07-05T10:27:24.967721+00:00"},{"alias_kind":"pith_short_16","alias_value":"236RC4Y3T6CX4HYX","created_at":"2026-07-05T10:27:24.967721+00:00"},{"alias_kind":"pith_short_8","alias_value":"236RC4Y3","created_at":"2026-07-05T10:27:24.967721+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":11,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.13647","citing_title":"SkMTEB: Slovak Massive Text Embedding Benchmark and Model Adaptation","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2607.01977","citing_title":"OntoLearner: A Modular Python Library for Ontology Learning with Large Language Models","ref_index":14,"is_internal_anchor":false},{"citing_arxiv_id":"2607.01852","citing_title":"Evaluating Chunking Strategies for Retrieval-Augmented Generation on Academic Texts","ref_index":32,"is_internal_anchor":false},{"citing_arxiv_id":"2606.09362","citing_title":"Zero-Shot Semantic Re-Identification for Autonomous Driving: A VLM Baseline Study","ref_index":19,"is_internal_anchor":false},{"citing_arxiv_id":"2606.04300","citing_title":"Argus-Retriever: Vision-LLM Late-Interaction Retrieval with Region-Aware Query-Conditioned MoE for Visual Document Retrieval","ref_index":23,"is_internal_anchor":false},{"citing_arxiv_id":"2606.29068","citing_title":"A Comparative Study on Affective Cues in Text Embeddings Across Psychological Emotion Theories","ref_index":37,"is_internal_anchor":false},{"citing_arxiv_id":"2606.18103","citing_title":"HistoRAG: Embedding Historical Methodology in Retrieval-Augmented Generation Through Critical Technical Practice","ref_index":29,"is_internal_anchor":false},{"citing_arxiv_id":"2605.22247","citing_title":"IdioLink: Retrieving Meaning Beyond Words Across Idiomatic and Literal Expressions","ref_index":38,"is_internal_anchor":false},{"citing_arxiv_id":"2603.19339","citing_title":"Spectral Tempering for Embedding Compression in Dense Passage Retrieval","ref_index":30,"is_internal_anchor":false},{"citing_arxiv_id":"2604.16380","citing_title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","ref_index":43,"is_internal_anchor":false},{"citing_arxiv_id":"2604.23396","citing_title":"Lost in Decoding? Reproducing and Stress-Testing the Look-Ahead Prior in Generative Retrieval","ref_index":24,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT","json":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT.json","graph_json":"https://pith.science/api/pith-number/236RC4Y3T6CX4HYXS6PEU23YAT/graph.json","events_json":"https://pith.science/api/pith-number/236RC4Y3T6CX4HYXS6PEU23YAT/events.json","paper":"https://pith.science/paper/236RC4Y3"},"agent_actions":{"view_html":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT","download_json":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT.json","view_paper":"https://pith.science/paper/236RC4Y3","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.07972&json=true","fetch_graph":"https://pith.science/api/pith-number/236RC4Y3T6CX4HYXS6PEU23YAT/graph.json","fetch_events":"https://pith.science/api/pith-number/236RC4Y3T6CX4HYXS6PEU23YAT/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT/action/timestamp_anchor","attest_storage":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT/action/storage_attestation","attest_author":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT/action/author_attestation","sign_citation":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT/action/citation_signature","submit_replication":"https://pith.science/pith/236RC4Y3T6CX4HYXS6PEU23YAT/action/replication_record"}},"created_at":"2026-07-05T10:27:24.967721+00:00","updated_at":"2026-07-05T10:27:24.967721+00:00"}