{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:JNS2JVFPVJGHTGVS2GPLJ4SWKZ","short_pith_number":"pith:JNS2JVFP","schema_version":"1.0","canonical_sha256":"4b65a4d4afaa4c799ab2d19eb4f256567bb889bb7a483aa688d44e0a360f99a6","source":{"kind":"arxiv","id":"2404.06347","version":2},"attestation_state":"computed","paper":{"title":"RAR-b: Reasoning as Retrieval Benchmark","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.IR"],"primary_cat":"cs.CL","authors_text":"Chenghao Xiao, G Thomas Hudson, Noura Al Moubayed","submitted_at":"2024-04-09T14:34:48Z","abstract_excerpt":"Semantic textual similartiy (STS) and information retrieval tasks (IR) tasks have been the two major avenues to record the progress of embedding models in the past few years. Under the emerging Retrieval-augmented Generation (RAG) paradigm, we envision the need to evaluate next-level language understanding abilities of embedding models, and take a conscious look at the reasoning abilities stored in them. Addressing this, we pose the question: Can retrievers solve reasoning problems? By transforming reasoning tasks into retrieval tasks, we find that without specifically trained for reasoning-le"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2404.06347","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2024-04-09T14:34:48Z","cross_cats_sorted":["cs.IR"],"title_canon_sha256":"98b77d19dc5f064d6d833e764eaaaa9f5ebe3bd8b86e05485c6db82fe90629ad","abstract_canon_sha256":"b287b6c19ee4f1d3ccb7ec485cce0b403132af840be461e5c07a6e3fc01a5c5b"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:18:06.990298Z","signature_b64":"Y9t86TQJjs4LFpKmfXt/XyQGmwQrCWrq5JzBHPyWn/gKYLKqGdRYH3AMqczdjPkphpSzfnFK8HKhSHyWO5A2BQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"4b65a4d4afaa4c799ab2d19eb4f256567bb889bb7a483aa688d44e0a360f99a6","last_reissued_at":"2026-07-05T08:18:06.989809Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:18:06.989809Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"RAR-b: Reasoning as Retrieval Benchmark","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.IR"],"primary_cat":"cs.CL","authors_text":"Chenghao Xiao, G Thomas Hudson, Noura Al Moubayed","submitted_at":"2024-04-09T14:34:48Z","abstract_excerpt":"Semantic textual similartiy (STS) and information retrieval tasks (IR) tasks have been the two major avenues to record the progress of embedding models in the past few years. Under the emerging Retrieval-augmented Generation (RAG) paradigm, we envision the need to evaluate next-level language understanding abilities of embedding models, and take a conscious look at the reasoning abilities stored in them. Addressing this, we pose the question: Can retrievers solve reasoning problems? By transforming reasoning tasks into retrieval tasks, we find that without specifically trained for reasoning-le"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2404.06347","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2404.06347/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2404.06347","created_at":"2026-07-05T08:18:06.989857+00:00"},{"alias_kind":"arxiv_version","alias_value":"2404.06347v2","created_at":"2026-07-05T08:18:06.989857+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2404.06347","created_at":"2026-07-05T08:18:06.989857+00:00"},{"alias_kind":"pith_short_12","alias_value":"JNS2JVFPVJGH","created_at":"2026-07-05T08:18:06.989857+00:00"},{"alias_kind":"pith_short_16","alias_value":"JNS2JVFPVJGHTGVS","created_at":"2026-07-05T08:18:06.989857+00:00"},{"alias_kind":"pith_short_8","alias_value":"JNS2JVFP","created_at":"2026-07-05T08:18:06.989857+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":5,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.22778","citing_title":"HAKARI-Bench: A Lightweight Benchmark for Comparing Retrieval Architectures and Efficiency Settings under Unified Conditions","ref_index":143,"is_internal_anchor":false},{"citing_arxiv_id":"2605.13521","citing_title":"Granite Embedding Multilingual R2 Models","ref_index":19,"is_internal_anchor":false},{"citing_arxiv_id":"2603.28052","citing_title":"Meta-Harness: End-to-End Optimization of Model Harnesses","ref_index":51,"is_internal_anchor":false},{"citing_arxiv_id":"2605.04018","citing_title":"Rethinking Reasoning-Intensive Retrieval: Evaluating and Advancing Retrievers in Agentic Search Systems","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2605.00063","citing_title":"A Survey of Reasoning-Intensive Retrieval: Progress and Challenges","ref_index":77,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ","json":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ.json","graph_json":"https://pith.science/api/pith-number/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/graph.json","events_json":"https://pith.science/api/pith-number/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/events.json","paper":"https://pith.science/paper/JNS2JVFP"},"agent_actions":{"view_html":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ","download_json":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ.json","view_paper":"https://pith.science/paper/JNS2JVFP","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2404.06347&json=true","fetch_graph":"https://pith.science/api/pith-number/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/graph.json","fetch_events":"https://pith.science/api/pith-number/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/action/timestamp_anchor","attest_storage":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/action/storage_attestation","attest_author":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/action/author_attestation","sign_citation":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/action/citation_signature","submit_replication":"https://pith.science/pith/JNS2JVFPVJGHTGVS2GPLJ4SWKZ/action/replication_record"}},"created_at":"2026-07-05T08:18:06.989857+00:00","updated_at":"2026-07-05T08:18:06.989857+00:00"}