{"as_of":"2026-08-04T04:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7fb6733d512e10bbe236877422151d48c754f26d717809ad3035c7ef514f40ac","coverage":[{"denominator":172,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T17:46:46.845424Z","state":"measured"},{"denominator":161,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":161,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":61,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:36:12.959685Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2404.13004","last_updated":"2026-04-19T12:08:14Z","snapshot_observed_at":"2026-07-06T18:02:49.215786Z","submitted_at":"2024-04-19T17:01:46Z","title":"A Unified Framework for Modeling Heterogeneous Financial Data via Dual-Granularity Prompting","version":6},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-24T02:21:22.149668Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2404.13004"},"observation_digest":"sha256:73190ee739bcfa1357021d6d85c63369ccbeb2bb81af17a0fd748bf627267dcc","observation_id":"fadb89a8-8af4-4965-9bc3-4a855e2a3aa4","resolution":{"observed_at":"2026-05-24T02:23:45.920558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2505.20414","last_updated":"2026-04-29T08:48:06Z","snapshot_observed_at":"2026-07-31T08:02:40.227933Z","submitted_at":"2025-05-26T18:05:59Z","title":"RetroMotion: Retrocausal Motion Forecasting Models are Instructable","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-19T12:43:30.765587Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2505.20414"},"observation_digest":"sha256:6240508caf04897e0784d1aa64fd64a2460347ccb72961825eff61421c4fb89b","observation_id":"0909a11c-6167-4f58-a95b-b43bccafb771","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2507.00994","last_updated":"2026-05-05T08:00:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-01T17:45:48Z","title":"Should We Still Pretrain Encoders with Masked Language Modeling?","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-19T06:31:37.201344Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2507.00994"},"observation_digest":"sha256:120934347760d134185db60d053135c2036621f2d70ea3b2fc2a570971917e74","observation_id":"737c2606-012c-49a7-aa04-39ba891108f3","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2507.20993","last_updated":"2026-07-28T14:40:44Z","snapshot_observed_at":"2026-08-02T22:49:57.855404Z","submitted_at":"2025-07-28T16:52:31Z","title":"Annotation-Assisted Learning of Treatment Policies From Multimodal Electronic Health Records","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T02:18:54.124568Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2507.20993"},"observation_digest":"sha256:4da0727a8dccf1688dbb52109c2af1f2fb33eb4126c8c5a3d1a110b5791f9de9","observation_id":"c6cbd539-0525-440b-bf0e-8e956f80b47e","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2509.00798","last_updated":"2026-04-22T02:56:00Z","snapshot_observed_at":"2026-07-29T03:25:03.283753Z","submitted_at":"2025-08-31T11:14:54Z","title":"Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering","version":7},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-18T20:04:52.852253Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2509.00798"},"observation_digest":"sha256:4f934a70669d9018b062b286cbb5e4e668e92281939927e282aa414d1299156a","observation_id":"b7cf9465-bae2-41d6-9373-131fd92cdbc3","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2512.11108","last_updated":"2026-04-20T14:05:19Z","snapshot_observed_at":"2026-08-02T20:26:54.594431Z","submitted_at":"2025-12-11T20:48:22Z","title":"Explanation Bias is a Product: Revealing the Hidden Lexical and Position Preferences in Post-Hoc Feature Attribution","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T22:45:09.677680Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2512.11108"},"observation_digest":"sha256:dadfc3fd6a930990851c180cdc00a7b741a528b8bd20b045528d0a8faba6ddb3","observation_id":"0c08f4e7-78b7-4abc-a7c4-32c508c5355b","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-03T12:36:12.959685Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02580","last_updated":"2026-07-24T20:17:29Z","snapshot_observed_at":"2026-08-03T12:36:09.462612Z","submitted_at":"2026-01-05T22:11:41Z","title":"Reconstructing Item Characteristic Curves using Fine-Tuned Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T12:36:12.959685Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2601.02580"},"observation_digest":"sha256:a77e1d860e746b228d84155d9866ad38df56973f75f29e523f1bb7d1c62f6cba","observation_id":"46190640-b95b-4675-a18b-a8a9add2974c","resolution":{"observed_at":"2026-08-03T12:36:12.959685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-03T10:23:06.872058Z","title":"InProceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, pages 13274–13292, Miami, Florida, USA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.10406","last_updated":"2026-01-15T13:57:15Z","snapshot_observed_at":"2026-08-03T10:23:05.352556Z","submitted_at":"2026-01-15T13:57:15Z","title":"ErrEval: Error-Aware Evaluation for Question Generation through Explicit Diagnostics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T10:23:06.872058Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2601.10406"},"observation_digest":"sha256:ac8b79a3d0e56dfe551a404435204f31f90409935a8f87294b34a1342fcbeeea","observation_id":"e1e93cd4-dd89-4ca3-a419-e7d51160c380","resolution":{"observed_at":"2026-08-03T10:23:06.872058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-03T07:04:45.141270Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.21416","last_updated":"2026-06-24T09:10:01Z","snapshot_observed_at":"2026-08-03T17:33:28.586472Z","submitted_at":"2026-01-29T08:55:53Z","title":"Spotlighting Task-Relevant Features: Object-Centric Representations for Better Generalization in Robotic Manipulation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T07:04:45.141270Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2601.21416"},"observation_digest":"sha256:cd91401b4ffe05157454707b4d900743c99adba8f6d0c2fb9e13a4e5c0cde26c","observation_id":"77cb87b8-187f-405d-aee0-3db50a90b3e6","resolution":{"observed_at":"2026-08-03T07:04:45.141270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-03T03:25:01.093665Z","title":"Smarter, better, faster, longer: A modern bidirectional en- coder for fast, memory efficient, and long context finetuning and inference.arXiv preprint arXiv:2412.13663, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08337","last_updated":"2026-07-02T05:59:45Z","snapshot_observed_at":"2026-08-04T01:08:48.151736Z","submitted_at":"2026-02-09T07:22:14Z","title":"Language-Guided Transformer Tokenizer for Human Motion Generation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-03T03:25:01.093665Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2602.08337"},"observation_digest":"sha256:d47147889faef8b478cd80fd0575bbc2d88225e42675d1280b20c79c5f8fbef4","observation_id":"562cdbbb-982f-49b7-baab-87e459c0f035","resolution":{"observed_at":"2026-08-03T03:25:01.093665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-02T22:39:13.277074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.16299","last_updated":"2026-07-06T07:51:55Z","snapshot_observed_at":"2026-08-04T01:10:12.360676Z","submitted_at":"2026-02-18T09:30:29Z","title":"MICE: Minimal Interaction Cross-Encoders for efficient Re-ranking","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T22:39:13.277074Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2602.16299"},"observation_digest":"sha256:2571b8d37c0c2bb9303efc783a44c8388209f85badfb3561429fb68742a6db3b","observation_id":"423dd630-8c97-48a0-b5d7-b33752cf4603","resolution":{"observed_at":"2026-08-02T22:39:13.277074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-02T21:31:20.639552Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference.arXiv preprint arXiv:2412.13663, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04444","last_updated":"2026-06-03T06:35:07Z","snapshot_observed_at":"2026-08-02T21:31:14.064176Z","submitted_at":"2026-02-23T15:00:01Z","title":"vLLM Semantic Router: Signal Driven Decision Routing for Mixture-of-Modality Models","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T21:31:20.639552Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2603.04444"},"observation_digest":"sha256:4cc4dd3aa02cad9513e0b7e4584e2e024d10af89e824b26589e39fdf0ea14ccc","observation_id":"8fe8819b-8db9-4ddc-8912-d6928b5bee11","resolution":{"observed_at":"2026-08-02T21:31:20.639552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.06193","last_updated":"2026-03-11T21:08:55Z","snapshot_observed_at":"2026-07-06T22:54:44.656835Z","submitted_at":"2026-03-11T21:08:55Z","title":"Depression Detection at the Point of Care: Automated Analysis of Linguistic Signals from Routine Primary Care Encounters","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T12:45:26.938841Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.06193"},"observation_digest":"sha256:63b6852d1ee0a66ac2a20416a839134852fb76937b8faff58f6e1f1cfbb8ac0c","observation_id":"14d1feb7-32da-4084-bd7b-7a20166590cc","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.07985","last_updated":"2026-04-15T08:44:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T08:55:38Z","title":"Rag Performance Prediction for Question Answering","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T18:00:47.818568Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.07985"},"observation_digest":"sha256:7eb3a675edb4477929184520633e907c87b877f69d0b1286ac8ea1955d36b986","observation_id":"1c105bf5-6ca9-4567-9e12-794871c158c6","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.18603","last_updated":"2026-04-09T19:32:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T19:32:11Z","title":"Dual Triangle Attention: Effective Bidirectional Attention Without Positional Embeddings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:50:43.716813Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.18603"},"observation_digest":"sha256:e96cc1ea99b04dfedff106e5dca852fbf79ab8d348312a42ac9d9582ed2a7f8d","observation_id":"295780b5-9536-44b0-95db-cda573611399","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.19921","last_updated":"2026-04-21T19:00:28Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-21T19:00:28Z","title":"Commonsense Knowledge with Negation: A Resource to Enhance Negation Understanding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-10T02:23:27.261915Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.19921"},"observation_digest":"sha256:8d006a2bfdaf192c0ad3913e9956d58e001c3e3ad4f4301b02da55686aa2fabb","observation_id":"7fb1bdfd-e958-4abf-ab73-e8e142d467fc","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.23488","last_updated":"2026-07-31T19:56:49Z","snapshot_observed_at":"2026-08-04T03:15:10.411864Z","submitted_at":"2026-04-26T01:26:50Z","title":"Do Prompt-Elicited Trajectories Reflect Training-Time Reward Hacking? A Systematic Study on Monitoring Training-Time Reward Hacking in Code Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T06:38:32.413172Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.23488"},"observation_digest":"sha256:1e7319ef45629b779fe2282292c986bb5c27aac058d3d46d87e822e7ced5e1e0","observation_id":"50a99450-0c03-48fe-9d57-435fdd24bb56","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.23488","last_updated":"2026-07-31T19:56:49Z","snapshot_observed_at":"2026-08-04T03:15:10.411864Z","submitted_at":"2026-04-26T01:26:50Z","title":"Do Prompt-Elicited Trajectories Reflect Training-Time Reward Hacking? A Systematic Study on Monitoring Training-Time Reward Hacking in Code Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T09:56:48.019404Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.23488"},"observation_digest":"sha256:abfcca34da42b7b8ba12ca9fe7408bee6daf430d5813b2f8fdff086458d59fd6","observation_id":"7cd6f78b-dce9-4afe-a746-e79d80bcf2ac","resolution":{"observed_at":"2026-07-01T10:05:40.174581Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2604.26483","last_updated":"2026-04-29T09:48:44Z","snapshot_observed_at":"2026-08-02T12:48:50.463577Z","submitted_at":"2026-04-29T09:48:44Z","title":"Efficient Listwise Reranking with Compressed Document Representations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T10:44:37.955281Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2604.26483"},"observation_digest":"sha256:a817e60163cf9f9d3d44cb6aa5471d100ac1b7cfee414fc5d55a0ce32fc45a30","observation_id":"9cef02c3-2c35-48cc-bf6b-e66b91c411db","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.00086","last_updated":"2026-07-29T13:50:34Z","snapshot_observed_at":"2026-08-02T23:16:54.324662Z","submitted_at":"2026-04-30T17:16:05Z","title":"NorBERTo: A ModernBERT Model Trained for Portuguese with 331 Billion Tokens Corpus","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T20:53:34.118813Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.00086"},"observation_digest":"sha256:aea3ecc6e2473ce65dcaef91009c370efcf299bac3ec6ac33d8c006b59bfb285","observation_id":"6399ae54-238a-4a38-a269-a1aec1edf835","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-02T15:10:40.659252Z","title":"In Proceedings of the Thirteenth Language Resources and Evaluation Con- ference, pages 7174–7183","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.00086","last_updated":"2026-07-29T13:50:34Z","snapshot_observed_at":"2026-08-02T23:16:54.324662Z","submitted_at":"2026-04-30T17:16:05Z","title":"NorBERTo: A ModernBERT Model Trained for Portuguese with 331 Billion Tokens Corpus","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T15:10:40.659252Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.00086"},"observation_digest":"sha256:d74e2b9be1489629268d4b8223e8e0b2fccb3fd23049e8a00afdd894f7517c01","observation_id":"a4fda9c4-e0b2-4735-98ef-deb9ff95edf2","resolution":{"observed_at":"2026-08-02T15:10:40.659252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.07554","last_updated":"2026-05-08T10:30:54Z","snapshot_observed_at":"2026-07-06T23:19:56.415523Z","submitted_at":"2026-05-08T10:30:54Z","title":"ProteinJEPA: Latent prediction complements protein language models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-11T02:43:17.116354Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.07554"},"observation_digest":"sha256:aa8bbf32cfa35c726ab1f4fb76a6724d5a61e546fd6fc2019d8d4f89e5edc848","observation_id":"a0295620-042b-4b6f-8845-fc184e4689cf","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.07622","last_updated":"2026-05-08T11:48:22Z","snapshot_observed_at":"2026-08-02T05:48:50.765177Z","submitted_at":"2026-05-08T11:48:22Z","title":"Is She Even Relevant? When BERT Ignores Explicit Gender Cues","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-11T02:13:26.019184Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.07622"},"observation_digest":"sha256:7b5c2ef4f26d6fb25be1a71a93ac835538a7c235a084b24193a0c83e0678dd94","observation_id":"aec64c26-3b39-4527-996c-211000c1d9c8","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.07982","last_updated":"2026-05-08T16:44:07Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T16:44:07Z","title":"GLiGuard: Schema-Conditioned Classification for LLM Safeguard","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-11T03:19:11.495230Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.07982"},"observation_digest":"sha256:1892375e1d7d66ec7324c4a4aa52da4bdeef0817786821a5e3e89a9604505dec","observation_id":"2beab3a0-0ee3-43c9-a27a-a852d8cf41a1","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.08254","last_updated":"2026-05-07T19:38:12Z","snapshot_observed_at":"2026-07-06T23:20:28.875586Z","submitted_at":"2026-05-07T19:38:12Z","title":"HyperTransport: Amortized Conditioning of T2I Generative Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T01:56:34.395472Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.08254"},"observation_digest":"sha256:0f6cea3579bf97d44d9c07cc1141adce95da3d439bb224cb411d171577a2693f","observation_id":"dea73a9e-4448-4684-8514-d82342991366","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.16035","last_updated":"2026-05-15T15:10:33Z","snapshot_observed_at":"2026-08-01T21:51:32.153409Z","submitted_at":"2026-05-15T15:10:33Z","title":"Who Owns This Agent? Tracing AI Agents Back to Their Owners","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T17:26:23.647993Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.16035"},"observation_digest":"sha256:6241e3424ceb27bc3bf844c1ad4ea2b545661e28652ad855f8448696bd434818","observation_id":"e64c3c72-76b2-4263-be53-d8aabdea3ae3","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.16991","last_updated":"2026-05-16T13:22:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-16T13:22:57Z","title":"Response-free item difficulty modelling for multiple-choice items with fine-tuned transformers: Component-wise representation and multi-task learning","version":1},"reference_index":182,"source":"arxiv_source","source_observed_at":"2026-05-19T20:22:55.750693Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.16991"},"observation_digest":"sha256:843a619bc4b67b2ff368c9f0c7f0dfdd4ff70fd1a50341e3dc6a27e888bd7aa0","observation_id":"a4d7e0fa-2d16-486e-94a4-f9114f77e0e8","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.17106","last_updated":"2026-05-16T18:19:30Z","snapshot_observed_at":"2026-07-06T23:28:12.114488Z","submitted_at":"2026-05-16T18:19:30Z","title":"HyDRA: Hybrid Dynamic Routing Architecture for Heterogeneous LLM Pools","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T15:13:27.898371Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.17106"},"observation_digest":"sha256:3491f835dd0b78ff9e354e5dad00c3c6a82834c05ffab039401a3b506cf0ec6e","observation_id":"689a0109-106b-4d32-8c5c-5af80c536b26","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.17201","last_updated":"2026-05-17T00:04:08Z","snapshot_observed_at":"2026-08-02T15:17:08.314805Z","submitted_at":"2026-05-17T00:04:08Z","title":"Filter-then-Verify: A Multiphase GNN and ModernBERT Framework for Social Engineering Detection in Email Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T13:44:00.578788Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.17201"},"observation_digest":"sha256:0ecc28050de5bc2ccf6f5080b27d48cceebb253faae3ad2d89b8627445ece8fc","observation_id":"0e14b5ce-04c0-460c-9773-935ff0fcc5c6","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.19568","last_updated":"2026-05-19T09:13:49Z","snapshot_observed_at":"2026-08-01T10:27:19.636512Z","submitted_at":"2026-05-19T09:13:49Z","title":"m3BERT: A Modern, Multi-lingual, Matryoshka Bidirectional Encoder","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T06:03:28.169346Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.19568"},"observation_digest":"sha256:ac5d7ddfad6240fc0786e4e1004736ab05826c29860945ff5305b6e5a15e64b8","observation_id":"4977a665-2ec9-48a3-95fe-4878962531d4","resolution":{"observed_at":"2026-05-20T17:46:47.428650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.20713","last_updated":"2026-05-20T05:10:18Z","snapshot_observed_at":"2026-08-02T04:33:28.078200Z","submitted_at":"2026-05-20T05:10:18Z","title":"SAVER: Selective As-Needed Vision Evidence for Multimodal Information Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T05:25:33.812361Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.20713"},"observation_digest":"sha256:cf5488b18bdeb1a0ac45126c0102367f111de0d8094e7bce5f1326e2daab2d74","observation_id":"a630d8a2-4507-4bdb-b902-1d01c9851986","resolution":{"observed_at":"2026-05-21T05:29:39.212783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.24296","last_updated":"2026-05-26T03:53:29Z","snapshot_observed_at":"2026-07-06T23:34:23.087565Z","submitted_at":"2026-05-22T23:49:52Z","title":"When Does Synthetic Patent Data Help? Volume-Fidelity Trade-offs in Low-Resource Multi-Label Classification","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-30T15:18:05.184085Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.24296"},"observation_digest":"sha256:111f5cd1ece18ed9ef3039321d893364092cc896e97fc36416529e6eb39a106e","observation_id":"71ff860d-de00-4418-bc8e-60a41dca84d0","resolution":{"observed_at":"2026-06-30T15:24:50.149135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2605.26935","last_updated":"2026-05-26T12:28:20Z","snapshot_observed_at":"2026-08-03T16:34:57.220613Z","submitted_at":"2026-05-26T12:28:20Z","title":"DunbaaBERT: From Sacrifice to Semantics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T18:06:59.505897Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2605.26935"},"observation_digest":"sha256:38e1063f29a4c2433002ee48a1c6d9191d1364e0c646d62ed1af1aa09207ebbd","observation_id":"82c6f385-1508-41c0-b251-e303c61e60fc","resolution":{"observed_at":"2026-06-29T18:13:48.919848Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.01904","last_updated":"2026-06-02T06:52:52Z","snapshot_observed_at":"2026-07-06T23:42:26.018647Z","submitted_at":"2026-06-01T08:42:55Z","title":"KliniskVestBERT: BERT Model Specialised to Norwegian Clinical Texts","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T14:32:23.329860Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.01904"},"observation_digest":"sha256:22f107ff65cadd33d4548e9eb884b66b441500d60421b8bda7a7592121931e66","observation_id":"5d2f3a32-5f4c-4898-88db-8b0d80586aef","resolution":{"observed_at":"2026-07-01T23:16:24.001363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.07587","last_updated":"2026-05-27T19:29:01Z","snapshot_observed_at":"2026-07-31T18:45:52.517819Z","submitted_at":"2026-05-27T19:29:01Z","title":"The Routing Plateau: Understanding and Breaking the Accuracy Limits of LLM Routers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-29T14:07:26.366172Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.07587"},"observation_digest":"sha256:36efdd5fb2540aad6dcaa680f508624188c449c1440ad7d9ef08805344f6d4c3","observation_id":"c1d9e5b4-1dc6-4061-9143-5f8826e44a8f","resolution":{"observed_at":"2026-06-29T14:13:30.265209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.09459","last_updated":"2026-06-08T13:14:01Z","snapshot_observed_at":"2026-07-06T23:48:48.962930Z","submitted_at":"2026-06-08T13:14:01Z","title":"AbstRAG: Learning to Abstract for Retrieval Problems","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-27T16:41:47.653574Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.09459"},"observation_digest":"sha256:965cdc0c843c24f11769b7eab8759915ff4a42f77509f26f67cadb209817bfac","observation_id":"da1c25ad-7547-4b5b-bfc7-97707ed9016b","resolution":{"observed_at":"2026-07-03T01:17:30.873171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.12552","last_updated":"2026-06-10T18:03:19Z","snapshot_observed_at":"2026-07-06T23:51:27.152983Z","submitted_at":"2026-06-10T18:03:19Z","title":"Crossing the Validation Crisis: Cross-Validation Reduces Benchmarking Variance Surprisingly Well","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T10:08:06.931901Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.12552"},"observation_digest":"sha256:2fb43e3fe43be4255ddc541711e85d97819e93de50f2186cfeabe71067e919d9","observation_id":"a8fa014b-e6e7-4c5d-bb12-d46020272d1f","resolution":{"observed_at":"2026-07-03T10:17:57.700922Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.13100","last_updated":"2026-06-11T09:28:43Z","snapshot_observed_at":"2026-07-06T23:51:55.044440Z","submitted_at":"2026-06-11T09:28:43Z","title":"LEDGER: A Long-Context Benchmark of Corporate Annual Reports for Grounded Financial Retrieval and Extraction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T07:09:33.306631Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.13100"},"observation_digest":"sha256:e5c4494aa7ba3cabebd794c25982af26fe8a42a4c6302bd48cdf6dae5c372495","observation_id":"a2582022-f696-4840-9d99-745959d71bb1","resolution":{"observed_at":"2026-07-03T14:08:22.476797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.13241","last_updated":"2026-06-11T11:54:07Z","snapshot_observed_at":"2026-08-03T03:42:24.481346Z","submitted_at":"2026-06-11T11:54:07Z","title":"Brick: Spatial Capability Routing for the Mixture-of-Models (MoM) Paradigm","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T06:56:24.816467Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.13241"},"observation_digest":"sha256:27faa15258e61e9fa580144c51f19cd3af7dd77fd17a9dbb133f9a62d38b0f6e","observation_id":"7d4dd9b5-cecd-4508-b34f-b365c9ab6773","resolution":{"observed_at":"2026-07-03T14:48:32.728903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.18372","last_updated":"2026-06-16T18:18:58Z","snapshot_observed_at":"2026-08-02T22:42:54.707649Z","submitted_at":"2026-06-16T18:18:58Z","title":"Redact or Keep? A Fully Local AI Cascade for Educational Dialogue De-Identification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T00:54:27.215655Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.18372"},"observation_digest":"sha256:0b2c3281039ee0d0bf134e391e6a92f6bdad80004e5658b189657eb1f13b9d6f","observation_id":"b1aeab75-f021-47f7-a45b-25426ce71f12","resolution":{"observed_at":"2026-07-03T21:08:58.304513Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.18875","last_updated":"2026-06-17T09:52:39Z","snapshot_observed_at":"2026-07-06T23:54:13.575009Z","submitted_at":"2026-06-17T09:52:39Z","title":"Efficient Financial Language Understanding via Distillation with Synthetic Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T21:01:00.910007Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.18875"},"observation_digest":"sha256:7c000d55ee797050640a43b12d2bcf68b250a4297b6e66ef8a11b80569ed1adc","observation_id":"7061f061-0036-4fe9-902d-032412ea1bba","resolution":{"observed_at":"2026-07-04T00:49:17.742896Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.21647","last_updated":"2026-06-19T17:58:13Z","snapshot_observed_at":"2026-07-06T23:56:35.743669Z","submitted_at":"2026-06-19T17:58:13Z","title":"ConcernBERT: Learning Responsibilities Using Class Membership","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T13:26:48.359840Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.21647"},"observation_digest":"sha256:1ea86b80bb58c87639fc47e93f7a14c400fb9c329abdac94d69d93a512bec0ef","observation_id":"fe8bc884-f52a-491b-b071-3194498ab84c","resolution":{"observed_at":"2026-07-04T07:29:38.757482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.23919","last_updated":"2026-06-22T20:32:47Z","snapshot_observed_at":"2026-07-06T23:58:35.398963Z","submitted_at":"2026-06-22T20:32:47Z","title":"Unified Multi-Task Relevance Modeling for E-Commerce: Comparing Task Routing Architectures Across LLMs and Cross-Encoders","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T06:08:27.696658Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.23919"},"observation_digest":"sha256:a25b8d72ca60d8f4f81212431078303538162b0b89d5b0197f9f260722875a23","observation_id":"3e5022ca-1d30-4288-a89d-cf93b378c957","resolution":{"observed_at":"2026-07-04T12:49:51.921600Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.25782","last_updated":"2026-06-24T13:00:25Z","snapshot_observed_at":"2026-08-02T05:56:42.277319Z","submitted_at":"2026-06-24T13:00:25Z","title":"Do Encoders Suffice? A Systematic Comparison of Encoder and Decoder Safety Judges for LLM Adversarial Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-25T20:55:44.549142Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.25782"},"observation_digest":"sha256:80047e39f5a121af12fa33bd94d3b6fd9d29350b8dba8b8856dd056ed203854e","observation_id":"76ffe950-88ff-463d-b8d8-b4d68ad1521a","resolution":{"observed_at":"2026-07-04T20:00:07.979715Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.25923","last_updated":"2026-06-24T15:02:24Z","snapshot_observed_at":"2026-08-01T18:51:40.341967Z","submitted_at":"2026-06-24T15:02:24Z","title":"$\\text{DT}^2$: Decision-Targeted Digital Twins","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-25T20:08:13.039445Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.25923"},"observation_digest":"sha256:dfb9f1b28a77531262bb1b7f9cc556e85926196f87f437d0e9271bc87ce20ff7","observation_id":"11be2e65-9ffa-48d2-863c-eb9b08295c7c","resolution":{"observed_at":"2026-07-04T20:30:07.274309Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.26686","last_updated":"2026-06-25T07:15:33Z","snapshot_observed_at":"2026-07-07T00:01:01.437499Z","submitted_at":"2026-06-25T07:15:33Z","title":"Do Safety Guardrails Need to Reason? LeanGuard: A Fast and Light Approach for Robust Moderation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T04:57:21.984791Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.26686"},"observation_digest":"sha256:08b0920ffff75cc5546a4a25f6c52ef41f3c24bab4826c4339c99ee4b1ab69a7","observation_id":"9ea4f18f-e562-4779-b6bb-5aeed3b4b59e","resolution":{"observed_at":"2026-07-04T13:49:51.073454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.28186","last_updated":"2026-07-11T22:18:18Z","snapshot_observed_at":"2026-07-16T23:17:54.586391Z","submitted_at":"2026-06-26T15:32:17Z","title":"Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T03:58:32.372896Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.28186"},"observation_digest":"sha256:b5507f7d85951b01ff3d1383c3bba8ca3f9a36c9d2faa85876113ebcbb69632b","observation_id":"ed0f8d24-ca43-48d1-a398-f781b53ebe54","resolution":{"observed_at":"2026-07-01T17:15:51.645456Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-14T17:12:24.565155Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference, 2024.https://arxiv.org/abs/2412.13663","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.28186","last_updated":"2026-07-11T22:18:18Z","snapshot_observed_at":"2026-07-16T23:17:54.586391Z","submitted_at":"2026-06-26T15:32:17Z","title":"Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T17:12:24.565155Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.28186"},"observation_digest":"sha256:4dd051c385d07579e10ff309a81adf06a0ae6fed3ba711064e2d28da36ab5344","observation_id":"cd3d54cc-a251-499d-847c-0d3827810b19","resolution":{"observed_at":"2026-07-14T17:12:24.565155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2606.28538","last_updated":"2026-06-26T18:44:11Z","snapshot_observed_at":"2026-07-07T00:02:38.226622Z","submitted_at":"2026-06-26T18:44:11Z","title":"Legal Domain Adaptation of Modern BERT Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T01:23:29.874289Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2606.28538"},"observation_digest":"sha256:48fef0ff07e9d6c2008fb874f82044be7059b6b06b4d42718f03afebc1feea89","observation_id":"5b66c330-cf9a-4811-b1b9-707fad08d1a8","resolution":{"observed_at":"2026-07-01T15:25:48.839738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-12T05:31:27.450841Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03003","last_updated":"2026-07-03T06:37:57Z","snapshot_observed_at":"2026-07-12T05:31:27.220853Z","submitted_at":"2026-07-03T06:37:57Z","title":"psytechlab at CLPsych 2026: Utilising Natural Language Processing methods and Large Language Models for Social Media Text Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T05:31:27.450841Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.03003"},"observation_digest":"sha256:96d14282c215c8c8d4fac2b69e258062df831ded8ff5fe235c3fd5a634e9488c","observation_id":"90ca0899-1bc8-454d-8021-83162a6af417","resolution":{"observed_at":"2026-07-12T05:31:27.450841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-11T21:53:46.707268Z","title":"arXiv preprint arXiv:2412.13663 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04071","last_updated":"2026-07-18T19:23:45Z","snapshot_observed_at":"2026-08-02T08:45:15.290889Z","submitted_at":"2026-07-05T01:06:29Z","title":"Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T21:53:46.707268Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.04071"},"observation_digest":"sha256:f7b36afa089eddeadc983b5e5b59af63f62731a83dc633cc2e8fa28c9812d01c","observation_id":"79ca05db-b170-4290-a8c5-5e3847289c99","resolution":{"observed_at":"2026-07-11T21:53:46.707268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-02T08:45:15.948089Z","title":"arXiv preprint arXiv:2412.13663 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04071","last_updated":"2026-07-18T19:23:45Z","snapshot_observed_at":"2026-08-02T08:45:15.290889Z","submitted_at":"2026-07-05T01:06:29Z","title":"Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:45:15.948089Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.04071"},"observation_digest":"sha256:ddbf71fc8d0c7fbf185c594e671b6c82f955cd0d7feaa57edcff17024a7a1b02","observation_id":"961f9ad0-e8cc-4ddb-bc3c-cbd4d1806e25","resolution":{"observed_at":"2026-08-02T08:45:15.948089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2607.05803","last_updated":"2026-07-07T03:56:18Z","snapshot_observed_at":"2026-07-10T23:17:29.107456Z","submitted_at":"2026-07-07T03:56:18Z","title":"Quantifying and Expanding the Theoretical Capacity of Late-Interaction Retrieval Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-08T23:58:19.040016Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.05803"},"observation_digest":"sha256:33ddfbaf425d2e722e9c7e16f637992791b5e053b0ca331daf18995433776e12","observation_id":"3eec9b86-c90a-4825-8353-d17ecb335c2a","resolution":{"observed_at":"2026-07-09T00:05:48.095942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":"2412.13663","doi":"10.48550/arxiv.2412.13663","metadata_source":"pith","pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","venue":"cs.CL","work_id":"7fa3fba6-ef2d-4e2f-adbe-a7236ebb4009","year":2024},"citing_paper":{"arxiv_id":"2607.05908","last_updated":"2026-07-07T07:03:03Z","snapshot_observed_at":"2026-07-10T23:17:30.568536Z","submitted_at":"2026-07-07T07:03:03Z","title":"Drift Happens: An Empirical Study of Neural Architecture Robustness to Temporal Distribution Shift","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-08T21:06:05.019222Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.05908"},"observation_digest":"sha256:a32a12c870055c810505a574ea95d6827e8d7271ba8adbc6f73f2ea8fb42ff69","observation_id":"86e2fa92-f548-444a-a7f3-a9065faba0f2","resolution":{"observed_at":"2026-07-08T21:15:39.307817Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:55:00.127757+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-01T18:05:00.157060Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17415","last_updated":"2026-07-19T21:22:22Z","snapshot_observed_at":"2026-08-01T18:04:56.607041Z","submitted_at":"2026-07-19T21:22:22Z","title":"Transition-Aware Backend Dispatch for Edge LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T18:05:00.157060Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.17415"},"observation_digest":"sha256:fed092bbf17403277e4578178f7c07039ba13af150b1ff982af5f61cc43e65b3","observation_id":"5342c0c4-079a-43ae-ad4b-3f2b6757a5b1","resolution":{"observed_at":"2026-08-01T18:05:00.157060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-02T13:37:01.907968Z","title":"Smarter,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21610","last_updated":"2026-05-20T04:43:02Z","snapshot_observed_at":"2026-08-02T13:36:51.796140Z","submitted_at":"2026-05-20T04:43:02Z","title":"SCOPE and SCION: A Benchmark and an Auditable Reference Pipeline for Schema Induction and Fusion from Text","version":1},"reference_index":155,"source":"arxiv_source","source_observed_at":"2026-08-02T13:37:01.907968Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.21610"},"observation_digest":"sha256:df44bbd38774d921b72dcdc681cbd6b17d13156a9b5ec3afc34c7c956482eedc","observation_id":"c57e8dcc-63d2-4ad0-9286-e4e813e4e262","resolution":{"observed_at":"2026-08-02T13:37:01.907968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-01T03:20:33.355537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23204","last_updated":"2026-07-25T13:54:50Z","snapshot_observed_at":"2026-08-01T03:20:32.938570Z","submitted_at":"2026-07-25T13:54:50Z","title":"Low-Latency Turn-Taking via Context-Aware Preface Generation in a Real-World Dialogue Robot","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T03:20:33.355537Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.23204"},"observation_digest":"sha256:477fa013293e9a0c8394a027cd3b36f72b4a4669ecf375f4726d407267f5175d","observation_id":"d0809277-be22-4ef5-be6f-f4cf9e51f2e1","resolution":{"observed_at":"2026-08-01T03:20:33.355537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-07-31T23:42:25.352859Z","title":"arXiv preprint arXiv:2412.13663 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23354","last_updated":"2026-07-25T20:27:18Z","snapshot_observed_at":"2026-08-04T03:20:04.237702Z","submitted_at":"2026-07-25T20:27:18Z","title":"Scalably computing metric magnitude","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-31T23:42:25.352859Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.23354"},"observation_digest":"sha256:795db703c2c0a772cdee4b689bd9dee933d9cdf937461e1fe38fd996c4591381","observation_id":"beede90f-c698-43ba-aac0-3bcfb7e7a4fb","resolution":{"observed_at":"2026-07-31T23:42:25.352859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-01T03:16:00.723730Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference ( ModernBERT )","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25180","last_updated":"2026-07-28T01:13:37Z","snapshot_observed_at":"2026-08-01T03:15:51.543720Z","submitted_at":"2026-07-28T01:13:37Z","title":"Bekko Embedding: Parameter-Efficient Multilingual Retrieval with Ultra-Compact Encoders","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-08-01T03:16:00.723730Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.25180"},"observation_digest":"sha256:2b2a7df74554d3e1a6c4bc15037cf0d58855ee01a9ae6b55a3926960de8d901c","observation_id":"9e3a11de-7860-48b5-a161-7b34b574f5c1","resolution":{"observed_at":"2026-08-01T03:16:00.723730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-01T02:07:51.138731Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference.arXiv preprint arXiv:2412.13663, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25572","last_updated":"2026-07-28T10:59:04Z","snapshot_observed_at":"2026-08-03T18:30:44.117365Z","submitted_at":"2026-07-28T10:59:04Z","title":"Mapping CVEs to MITRE ATT&CK Techniques: A Curated Gold-Set Classifier and the Limits of LLM-Assisted Label Expansion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T02:07:51.138731Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.25572"},"observation_digest":"sha256:0944fbaf86724430b1df6a42466226e610abc49787e9cf2d8536b40399198745","observation_id":"16e8adb2-1607-43ed-83e0-650cc2b01b15","resolution":{"observed_at":"2026-08-01T02:07:51.138731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-01T04:44:50.254688Z","title":"arXiv preprint arXiv:2412.13663 URL:https://arxiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27611","last_updated":"2026-07-30T02:58:46Z","snapshot_observed_at":"2026-08-02T23:36:02.614573Z","submitted_at":"2026-07-30T02:58:46Z","title":"AWARE-FX: An Auditable Knowledge-Guided AI System for Measuring Corporate Foreign-Exchange Hedging Disclosure","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T04:44:50.254688Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2607.27611"},"observation_digest":"sha256:3ca353d10766964b7e3d55330f4c4b7d3d5ab641ce8cac0f74243014b8564083","observation_id":"7ce9d8aa-42cd-4ae9-8ff7-821b03195175","resolution":{"observed_at":"2026-08-01T04:44:50.254688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.13663/citation-record","integrity":"/paper/2412.13663/integrity","json":"/paper/2412.13663/citation-record.json","paper":"/paper/2412.13663"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"9f6e7da1-1c16-4cce-9b28-f1721f33983f","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:c972dd99e64ec38dd41acb8b6927103846d425f12c94f9917a505c70393d2bf9","observation_id":"21b8a0b9-635b-4f68-a6c9-f6ae333f5e0f","resolution":{"observed_at":"2026-05-20T17:46:47.180117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On Layer Normalization in the Transformer Architecture , booktitle =","venue":null,"work_id":"f0be99a8-4c7e-45c6-8d08-bf507b6adf47","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6f5845f0aa54cb3bd787c8acb6f8494f72fdb5d81bec8002aa1a17eae9c5ef2e","observation_id":"1d9d18bc-b4b3-49eb-8aa8-9abcbbcad911","resolution":{"observed_at":"2026-05-20T17:46:47.264925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"47eb255a-491c-4109-a3e1-392441d2ad69","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:f5505de7a2720fb2c0d80a816b9751d0ffdc92c223bfe46228a770286ed259f5","observation_id":"507cd8af-fc1b-42f0-ace7-5db4238c97b1","resolution":{"observed_at":"2026-05-20T17:46:47.267390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.642","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T19:17:17.441480Z","title":"Improving Text Embeddings with Large Language Models","venue":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"01d781a2-1c3d-48a4-a6e9-875269b9d544","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2552f42e62885b87f6ef0f9d79bd8c2057dda354f17453185f9a2c05271a60ca","observation_id":"30d51bdc-f9ea-43f4-8a40-5410efc44c1c","resolution":{"observed_at":"2026-05-20T17:46:46.961273Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T13:38:15.042139+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T13:38:15.042139+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , eprint=","venue":null,"work_id":"1d62380d-a9d0-45cd-842a-b343fbd91758","year":2018},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:4bc573d20f200737323d208e1b6ac2f0bb0d927d8cae29ddf74fe7877bb29fb8","observation_id":"73bbee8d-16ca-4653-9e18-c6f97a3ad20e","resolution":{"observed_at":"2026-05-20T17:46:47.269690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05961","last_updated":"2024-08-21T22:46:05Z","snapshot_observed_at":"2026-07-06T17:57:31.912970Z","submitted_at":"2024-04-09T02:51:05Z","title":"LLM2Vec: Large Language Models Are Secretly Powerful Text Encoders","version":2},"cited_work":{"arxiv_id":"2404.05961","doi":"10.48550/arxiv.2404.05961","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05961","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"LLM2Vec: Large language models are secretly powerful text encoders","venue":null,"work_id":"156e1320-54cd-416f-af15-d9da54374957","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2404.05961","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:86d7580040ff28ebcfe6aa99c9e7ba2dc3b0c2483f436ad0b7b9119a7d3a94d9","observation_id":"ebe71a4f-bfa8-415b-89d7-0fa2e098ce15","resolution":{"observed_at":"2026-05-20T17:46:46.916596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 5: Industry Track) , pages=","venue":null,"work_id":"dc273531-5c64-4293-9ed9-05d986740e34","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:65400d72dfcdf60578d797f2bb1db591d3be19d3abdb158e0c4a268da92f0074","observation_id":"45b725c8-95a3-472c-999d-38d8230d347d","resolution":{"observed_at":"2026-05-20T17:46:47.272535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T00:04:22.928165Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"1f61e55b-4d86-4e63-830a-b97138b0c71b","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:305ff8167bdecf94f858d55fe79b022a74f8623f35112fb8525a1f8a46600396","observation_id":"edf2b21f-2da2-40f1-b3e3-fa21062f2199","resolution":{"observed_at":"2026-05-20T17:46:47.275149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv e-prints , pages=","venue":null,"work_id":"9d156767-3442-4e4d-b369-4ad1fb386241","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:13539bffd351a32db181fe419bda635046194f7db649caf3bd90b767733f9fdd","observation_id":"9a3fe2a0-8481-4fde-997d-e0f05380e3dd","resolution":{"observed_at":"2026-05-20T17:46:47.277185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:42:40.380847Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":"be0d91d4-5ccd-48fc-8c2b-1adc59bf8310","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:89dcdd9815de63c8968d412e92a17dfae8fc40f9238cc70270fade656c00fec7","observation_id":"b974ebdc-1f59-46ce-adeb-e43bff839e21","resolution":{"observed_at":"2026-05-20T17:46:47.279888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T00:04:22.792596Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"bf4c2a2a-5d4c-4e52-9b3b-24d9abf680f2","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:d8646be336a006bff07f332744651e26aec67ab84618be9b0928020cbcd63c17","observation_id":"cd6fd752-31ea-4259-ac12-6b0ddb636f01","resolution":{"observed_at":"2026-05-20T17:46:47.282260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Eleventh International Conference on Learning Representations","venue":null,"work_id":"32e6d623-c3e5-43dc-9ab4-57756dd625b7","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:7553249c586de3126af94d7c9227cde5ce98a66d5bc581a03e429a807ff495b3","observation_id":"daa6491f-d6c1-4f84-8987-dabcdd8da920","resolution":{"observed_at":"2026-05-20T17:46:47.287988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"110471ed-c086-4758-9527-a938e87208c0","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:61eb11415f027d0b51cb05ee9605fb276bb6089e4f151dc591df302818e86673","observation_id":"dd3e9f31-6855-4f24-a6c7-eebbc330b94b","resolution":{"observed_at":"2026-05-20T17:46:47.290680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-07-11T02:47:49.837877Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:c7dfde0d42c3f3a32f2dd0656e3e703c99faf66765271f45ca7d5a6a374f89d7","observation_id":"3438c2bd-479c-41be-aa06-dd13c4777f2a","resolution":{"observed_at":"2026-05-20T17:46:47.014121Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"16ddb7b6-bc28-43e9-a166-bf322ee54d64","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:bddaf5ba455b2ee7d842f72454a25664ac4488a92d38141a3c0dbf71d56374e1","observation_id":"a1aeabb6-5c6b-4dab-9287-60b7eccd65a1","resolution":{"observed_at":"2026-05-20T17:46:47.293118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft Research Blog , volume=","venue":null,"work_id":"b92fa3a5-6a63-4307-aa38-21709249f50a","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:38e8d054fb6c3cdc9ca65c2b91698e0893def535a8c9f9484c98a6b04875fea0","observation_id":"c864b28d-89e5-4624-83dc-5a590edb8f60","resolution":{"observed_at":"2026-05-20T17:46:47.295986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-07-10T13:57:06.708632Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:a6ce3b2a1538206b06ac1aee23a85d2309c2ad44f433d2ea3ac7e46e2189ddd6","observation_id":"175085b7-fd76-4c0b-b251-593af9063f08","resolution":{"observed_at":"2026-05-20T17:46:47.121582Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval , booktitle =","venue":null,"work_id":"1b6a87b8-e75b-4e4d-80e7-c4026c02fad3","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:c191a6c389e5d665c4694acbd09d1efd80174ce8747f75c708d88d3e707b2cb2","observation_id":"ab6ae008-06ac-4f9c-808e-d9853b7d1198","resolution":{"observed_at":"2026-05-20T17:46:47.298758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Learning Representations (ICLR) 22 , year=","venue":null,"work_id":"f5f2df51-99ad-478d-9f8b-2840c8e75022","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:e5d2ea84ac91d71677b5f2c6dc733f1e30ba734f042931efac683bc4cfdf79d1","observation_id":"be0891cc-0065-4f48-b4e3-99aef6e08781","resolution":{"observed_at":"2026-05-20T17:46:47.300914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":"2403.08295","doi":"10.48550/arxiv.2403.08295","metadata_source":"pith","pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-07-10T23:07:48.332027Z","title":"Gemma: Open Models Based on Gemini Research and Technology","venue":"cs.CL","work_id":"a9ea2870-df28-40b8-a9e0-a7e9a116f793","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:be1fbf8169e3e9688c617ec61f5f82123c4a92debf0918270276f40fc643ccc0","observation_id":"270a18c5-92ce-4abb-b29b-9a7b0f2add93","resolution":{"observed_at":"2026-05-20T17:46:47.103647Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of BigScience Episode\\# 5--Workshop on Challenges & Perspectives in Creating Large Language Models , pages=","venue":null,"work_id":"8b687049-6969-4d31-9df4-276b0b76c37d","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:eb25e06ad0a8d4f522975af0e4a7c353821657ef4bbf97f1ed7915f88a92459f","observation_id":"2486f8ea-5461-4894-8d6d-6af8723582dd","resolution":{"observed_at":"2026-05-20T17:46:47.303349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T01:13:13.753995Z","title":"Neural networks , volume=","venue":null,"work_id":"5b6c0d6a-6670-45a2-bf05-7bb2d6a55c24","year":2018},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:d24250d4a185d7670ed5849cd122bc05599865c934dc04ab81ac2d3a94f3b32a","observation_id":"f67296e8-7fac-46fd-8e92-1dd64a279066","resolution":{"observed_at":"2026-05-20T17:46:47.305987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , journal=","venue":null,"work_id":"c2417f09-ec97-425e-b7ea-5631f4e29e39","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:ae7706aca9ce7e2a4ed02902f0cb530ad9a0196bb8e42e5d0fca61c420d98c56","observation_id":"512476fa-f740-4af5-ae12-d79001d32604","resolution":{"observed_at":"2026-05-20T17:46:47.308781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2018 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, Volume 1 (Long Papers) , pages=","venue":null,"work_id":"bdd6191c-58d5-4fb6-b9ff-d6966ad0a2db","year":2018},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:f6f1042e68db27ecd5b935d836b1b2db604a1375a5fd3d84ffda225fb07a87e4","observation_id":"858bbca2-4108-4ee2-97a2-276f276cbbc9","resolution":{"observed_at":"2026-05-20T17:46:47.311507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:42:39.987748Z","title":"2024 , eprint=","venue":null,"work_id":"0467720e-f223-4af5-b8c2-fa3d00a1df62","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:b38810b4edd2e483c34bfc4212ccf6992bb766cb3921ecdce507a4e30226676f","observation_id":"1489d71a-6062-432a-85e0-2dd13f94eb33","resolution":{"observed_at":"2026-05-20T17:46:47.313797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T19:11:21.976150Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"f988aa6e-24b8-4684-96c2-19f2ef08293d","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6e0bb12bf224674e2607ba4609fce141274b0bdffd73cec1b8cd04f68da59772","observation_id":"a6ba7ef5-a5da-4c4d-8b31-750d1acca5bc","resolution":{"observed_at":"2026-05-20T17:46:47.316080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , publisher=","venue":null,"work_id":"e24f41cc-a052-40bd-905b-ba3b62714db8","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2b0aead54d5b8e135e4377226a59554f7efd17d230c7e440a0b4a3e51c2ec6fd","observation_id":"be271247-be72-483d-b3a3-97d75c65586e","resolution":{"observed_at":"2026-05-20T17:46:47.318625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers) , pages=","venue":null,"work_id":"1098eb21-c9b2-4f2c-8625-2be8313e8792","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:516346636eb285a8d6f7cf463071da7dc1bf0a10cfb8ba51490a7f9e7874aca5","observation_id":"584c1563-99db-4cb7-bd4c-611bbf056954","resolution":{"observed_at":"2026-05-20T17:46:47.321178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , volume=","venue":null,"work_id":"f5af82cb-81ff-4e20-9e2c-287fc9adaaa0","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:0496cb5e165fd54aa483cd448b5fa8aab3f2e93237752f77e879aa22a3f9b9f5","observation_id":"d9acc599-b21d-4a59-b0a6-877eaf2b69fc","resolution":{"observed_at":"2026-05-20T17:46:47.323634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.165794Z","title":"Journal of machine learning research , volume=","venue":null,"work_id":"d1b76c93-2608-4f12-9b0e-1c71236cad23","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:98a3cf8ccf3b072c2696376fe18a7171921c046176f55db3e6ecd2c6e1477485","observation_id":"7614533a-cfb9-45d4-bf11-705e0a5ed648","resolution":{"observed_at":"2026-05-20T17:46:47.326626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"d18c4d00-72ea-463d-9a6f-b19132f17820","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:80c0edf64debeb6fe6ee891ba6e0f512d2fda881ef2ca8ac1a283001321e73bf","observation_id":"b638bc49-5392-4cba-a2c4-c01179942321","resolution":{"observed_at":"2026-05-20T17:46:47.329234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MosaicBERT","venue":null,"work_id":"8eab03c9-1f1b-49e5-aebf-7fdc24d21451","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:151f28a2d4c6c3ffab6703392a2cd4f8e9828aaa4baeb4c74b6e70f034e73f8a","observation_id":"c00e8108-54a0-4c2e-8ba8-501cc3b00f68","resolution":{"observed_at":"2026-05-20T17:46:47.332724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gomez and Lukasz Kaiser and Illia Polosukhin , editor =","venue":null,"work_id":"44e078f2-c826-48fd-8e5c-a1f3b3b4fad2","year":2017},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:859b17b89025a0da8db40cf80a4b80138830586862ebd8957922192b8df4a99c","observation_id":"85a04ff2-3fe8-4fc8-8230-a365555bffb4","resolution":{"observed_at":"2026-05-20T17:46:47.335587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages=","venue":null,"work_id":"fb1d1e35-e68c-478a-b57d-996143f50fb0","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:af782d69fecfa6cbd49865ebba0e5f1cd3e7ba6bd28c21ffbcb3fabebd844ad8","observation_id":"ebd120db-19e0-4422-b55e-8644f64083e2","resolution":{"observed_at":"2026-05-20T17:46:47.338281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , howpublished =","venue":null,"work_id":"d3681690-252f-47ce-846f-e7ebaee08f26","year":2021},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:0c09fabc262549e92570a02ea16f1459f83b09c3dd4501a94fc7f5a8cb9edbbb","observation_id":"bfb83048-ec58-445e-ae6f-6ff92ba57e54","resolution":{"observed_at":"2026-05-20T17:46:47.340627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Github , url=","venue":null,"work_id":"d78e571d-e51c-4627-9f46-9b370300fdcb","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2e4b18760d86f58f54b9071259d9f9b23ddf894fa5bb9b187aacf20d59f8ff90","observation_id":"6dadcd7a-1d14-4cc4-aac6-4ba797a0f6d9","resolution":{"observed_at":"2026-05-20T17:46:47.343119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Announcing Vespa Long-Context","venue":null,"work_id":"f05dbef1-6102-4bcf-b6e9-aa41d4ed6241","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:60fbe83be2ea373cfd11e12aeace1e393930a48943da55fe963eae834495de1f","observation_id":"af16aa2e-a0b7-4ea6-818f-c1f77a1e3e47","resolution":{"observed_at":"2026-05-20T17:46:47.345844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"8th International Conference on Learning Representations","venue":null,"work_id":"4a5fec63-173e-41b4-925e-598080e7636e","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:8d1f07984460e75d7c1416dd540fb6b2b5a9858337b371bf3ff29c13e9975425","observation_id":"5100db3b-6fbf-479e-aa44-c380cd94a871","resolution":{"observed_at":"2026-05-20T17:46:47.348855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cramming: Training a Language Model on a single","venue":null,"work_id":"944a23ab-0fcb-4097-abb7-51afd9b6c53a","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:b73a12cc9275c26efe84bc73abe73410d947d6fed7d326649dfb0a4275fa0a6b","observation_id":"4f0f33f2-f8e4-4044-ad3a-2ef173663c16","resolution":{"observed_at":"2026-05-20T17:46:47.351532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smith and Mike Lewis , title =","venue":null,"work_id":"7858238e-108d-4d62-a955-0fa677d63783","year":2022},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6f546c53c192c1b31a5378927e19aa731930b915ac97fffee5402a3f31aa2e87","observation_id":"add43c19-b2a2-4624-9683-4e013f63d69a","resolution":{"observed_at":"2026-05-20T17:46:47.353831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Twelfth International Conference on Learning Representations","venue":null,"work_id":"75c58f9e-7b9a-4222-b4a4-bf10a5b57943","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:f9572b661359316a2bf9ab04180934fa2e7f65e750b69c17e1dbf4f995627a27","observation_id":"bcc06539-41d7-4817-bc8b-87c1b9c73040","resolution":{"observed_at":"2026-05-20T17:46:47.356981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PaLM: Scaling Language Modeling with Pathways , journal =","venue":null,"work_id":"3f41320f-4575-49bd-8bea-88cc6b96d854","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:1156074ee4e5a586d12e20a899d787c63342d243535c04de69b5f2653366d155","observation_id":"0b4bc63c-4243-42fd-895f-ec5ea4fdd9f9","resolution":{"observed_at":"2026-05-20T17:46:47.359453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T11:43:42.458971Z","title":"Proceedings of the Neural Information Processing Systems Track on Datasets and Benchmarks 1, NeurIPS Datasets and Benchmarks 2021, December 2021, virtual , year =","venue":null,"work_id":"80613742-957b-4089-84cc-dc2aac0a3052","year":2021},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6b12d1f990349c4df8cb06f8d50e6301cc104739b8f37cd0f348c0cda50515b9","observation_id":"f8723752-b035-4325-8193-80e0b862c62c","resolution":{"observed_at":"2026-05-20T17:46:47.362038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"052be892-cc54-4cac-a8e1-2115da77cd9d","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:a7bc221a51b59a9f7fba8a66786e429ef87dd310b31d4ba1d40a504586b01864","observation_id":"c8fd1add-a8db-4ab6-8fdf-19d3e7780bda","resolution":{"observed_at":"2026-05-20T17:46:47.364802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T09:06:59.751302Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","venue":null,"work_id":"2b86c7ae-3954-47ab-84a9-bd4d58d9f694","year":2019},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:9d08cf325086544e385847c5e98b0bed4149540c6b8feb5bc464713cbcaa43d2","observation_id":"2190b685-e749-49a9-91d1-d893223f93f2","resolution":{"observed_at":"2026-05-20T17:46:47.368178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0f2b58b4-ed1d-41e7-a1c8-91947fb2f467","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:4b0b0b7f4683fe9f540d5e81cf3c5b43e7b1c4a17f747980087f7ee227ea1809","observation_id":"b3235963-0bad-474b-8352-b4da06ba9d3c","resolution":{"observed_at":"2026-05-20T17:46:47.370834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 34th International Conference on Machine Learning , pages =","venue":null,"work_id":"5f6146c8-420e-4f11-8998-1e7ce7c4991b","year":2017},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:219595aeb47733ff697345740ba86a20f0390ca3bf1fea1d45801e260e33656b","observation_id":"31ba4ba8-a3d0-49f1-bf51-fdae27c63057","resolution":{"observed_at":"2026-05-20T17:46:47.373559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACM SIGIR Forum , volume=","venue":null,"work_id":"586fb03e-b752-4850-8664-224cc37844d4","year":2021},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:05789839eea18654a1bbee43adb41d975ce1083472e5870dfa296a8bad472b08","observation_id":"5d5977b6-9805-45aa-a2d2-7db7bce1bdc5","resolution":{"observed_at":"2026-05-20T17:46:47.376281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"9696acf3-f5db-4011-8c82-7ddb60bd8fce","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:ffe25362de4ca012ae5d4abc0897a66fd5ca024371accf6b768a3e973fad9e9e","observation_id":"35d59017-f574-4ed1-bbf7-f59f55c74068","resolution":{"observed_at":"2026-05-20T17:46:47.379667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:40:41.103302Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"d2411c15-853a-4793-bf9b-e3eaf1633471","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:4f354ff7f2ca531ee8fcf941f62a090f709221a11ea5b2f7b59ffca7fcba4d50","observation_id":"2a745af0-837c-4825-b675-adf1473dca35","resolution":{"observed_at":"2026-05-20T17:46:47.382482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Computer Vision--ECCV 2020: 16th European Conference, Glasgow, UK, August 23--28, 2020, Proceedings, Part XIV 16 , pages=","venue":null,"work_id":"fbbddc7d-a8bf-41ac-a39b-8d5d626b9842","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:0890fded11390a06f0aa9492a250532482e0b52dac2c55bfc3a905e16afc0829","observation_id":"864812f4-c6bd-410e-a6b5-221954117b6f","resolution":{"observed_at":"2026-05-20T17:46:47.384910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T19:11:21.546039Z","title":"2024 , eprint=","venue":null,"work_id":"c266f192-9505-4b5f-a900-4fd9ef4aac80","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2ef08cc7fa4df336e93f1eb763aead80501cec460d29bf1b6c1cac13b4014d4c","observation_id":"d8c07c2b-2dda-4def-8c0c-5378956932b8","resolution":{"observed_at":"2026-05-20T17:46:47.387541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"29ba4248-0750-4363-8541-3d092bcad71e","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:06ef78f40a72a1912f3564891d94a0eae2f9ff1998f6390b372debf6dd9f84a7","observation_id":"bd40e29f-bdac-4f11-99bb-cfdd2232399c","resolution":{"observed_at":"2026-05-20T17:46:47.390617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"078527e4-3293-4ff9-9552-73890099b16a","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:ea5a1e82af4e01c070e46d17f1c0374538acc285a1c4be3a3a3dad5bb4bc39a8","observation_id":"3d2d483a-9fa8-49d8-9c26-b04f4b4e62cf","resolution":{"observed_at":"2026-05-20T17:46:47.393173Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T02:11:52.222682Z","title":"2023 , eprint=","venue":null,"work_id":"4de30a30-7c01-4709-86da-10d0cc099264","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2e65d07b9b0a8024ef8dc4b346cb21040583c55e393ce042e2f9739cc178e90e","observation_id":"deb9c98a-93d7-44db-bf65-8f8cf7083dce","resolution":{"observed_at":"2026-05-20T17:46:47.395533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"0f5a8306-3b22-412b-80d3-3d044e77e7bb","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:b8a374105815d5799955250b9b4a231030d0de03e7ada7c6ed44e96fa754026e","observation_id":"8b9bdec7-96fd-484b-a930-33b7f041f7ee","resolution":{"observed_at":"2026-05-20T17:46:47.398266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T05:30:43.851957Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":"d630399a-0eda-449a-ad22-842dcf41ffbd","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:384642213ceb2139de290ba3d152dbeddee148e3cacca207dc0ab9a132caa438","observation_id":"17d83b2b-5311-4220-ab22-0fd510a9a395","resolution":{"observed_at":"2026-05-20T17:46:47.400837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , eprint=","venue":null,"work_id":"b3859f83-763d-4798-9bf9-a480272cfbcf","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:b3a42ad5aa5ffa2d1cff289550fbd7016b688000e9196e007ed80a220dbe421c","observation_id":"1822bb31-207f-4798-ab7b-fca35c89b81d","resolution":{"observed_at":"2026-05-20T17:46:47.403899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"49cc08b9-e50e-4df5-a824-b1a3fa58252c","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:a863187956c049265376c03615dfffa7a15db492e544c8bd2e15572a39089d93","observation_id":"73736cf5-0dc7-4d90-885f-0f6bbe3ae126","resolution":{"observed_at":"2026-05-20T17:46:47.406653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"73784a02-b166-4cc8-949f-4046a6e30cd4","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:abbfc3cd640c812e926590bc925f8f5919bf15e4c3c8a037e84ec0c07b891a35","observation_id":"62628b94-5f5a-48a2-9f36-8062b1eb388e","resolution":{"observed_at":"2026-05-20T17:46:47.408633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"9a050c0e-0d2f-4f42-b24a-5b1d13b4179b","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:534d173b75f35d56fe936741a3f12fca3d21c4919f5abdd59e32257e0606f920","observation_id":"93745d5f-1022-405b-b1bb-85e67ab42885","resolution":{"observed_at":"2026-05-20T17:46:47.411287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.760109Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"c41c2b6d-2808-4a83-9537-f2d5bf48bc34","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:38a040e03dd4e075069a4f002a7004be8cea85ec494a59706e07708bcb925dac","observation_id":"79ad6d1e-df25-4cce-9a94-50a1dffaee50","resolution":{"observed_at":"2026-05-20T17:46:47.414647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 35th International Conference on Machine Learning , pages =","venue":null,"work_id":"22e4d7ba-660a-4e6e-a06f-2a7a91b78a09","year":2018},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:95512b7bbae90fca6ad5e05f043ad1aa2ed384d9bae41e81c6e10c103ba40452","observation_id":"d10bd811-f16c-4486-bb70-9ebe4a789bbe","resolution":{"observed_at":"2026-05-20T17:46:47.416821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"accaadaa-2b8c-4542-952f-4a9ff18734a4","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:4d881f07398793c30a3f1553dfc117e0b174f625d03771ae11330216b83f76d3","observation_id":"c77a151f-65e7-4426-a54b-8ae4d5887e4d","resolution":{"observed_at":"2026-05-20T17:46:47.419014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"5b8b739d-e37c-4153-97d2-c4949f15c5d8","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:08105aa3b7a3255b8f31cfb30a92758a8d023bc7f60c353ce1a9595375639206","observation_id":"763ab72e-3398-4acb-876f-e2a1a4fa2baf","resolution":{"observed_at":"2026-05-20T17:46:47.421392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenAI Tech Report","venue":null,"work_id":"9ae41686-2d7a-45f6-b07f-99d837424a97","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:0bd6799a229d5c6c4a89030e9248093fcaf8764562b0167c7a4a0c39aa4cf1be","observation_id":"b2ac9815-c9ce-47b7-959f-e39d58fe3fbd","resolution":{"observed_at":"2026-05-20T17:46:47.423503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language Models are Unsupervised Multitask Learners , year =","venue":null,"work_id":"3eccf19e-5bca-4c77-9e0a-73df03024a79","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2ccc798a0d422c62e0a5f4386aaeafc57d3788a9dffa88712b2e8c2c8eb9819f","observation_id":"a5b5a002-1748-46a8-a88b-8f1f06a884e4","resolution":{"observed_at":"2026-05-20T17:46:47.425795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T20:52:54.929304Z","title":"Narasimhan and Yuan Cao , title =","venue":null,"work_id":"0716e1ac-827a-4505-b0ba-8e6430ef450e","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:4f5ad5e936af1071d84891a8c35fa688c95e5bbb7200cacc8b9aeb58ebcaf469","observation_id":"9e588145-eac8-4ffe-afe8-34964c1621e0","resolution":{"observed_at":"2026-05-20T17:46:47.427830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools , booktitle =","venue":null,"work_id":"10743177-6c50-4ed6-9eec-e3b6171aeb0b","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:92acbaafc58ae3f0aa6b927b886f49d2df2972844ac92bc08af79ed1be5eb245","observation_id":"0ec911b4-728a-4644-a7ae-0fc5d99de7cf","resolution":{"observed_at":"2026-05-20T17:46:47.148479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 29th ACM International Conference on Architectural Support for Programming Languages and Operating Systems , volume=","venue":null,"work_id":"6819e39b-e403-475b-a1a4-6c058a2f6acf","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:22a6c03636318d65de47cc0968794f5c162317a343ae5e28ef669dd0443e572e","observation_id":"d5469c38-6fef-45d6-98cd-8bb3c62f39a9","resolution":{"observed_at":"2026-05-20T17:46:47.150859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:46:15.123762Z","title":"2020 , eprint=","venue":null,"work_id":"0ac81478-33dc-4fd2-a4f5-5f02fbcd124b","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:fb9e1068dc506fa0a15f7d5003de89076f4457a6c57efc6df396b63770ffc795","observation_id":"5b8018e5-183b-44aa-a810-23908a5973c0","resolution":{"observed_at":"2026-05-20T17:46:47.153893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"31881c45-9ea0-4096-849a-94cf0dc323f9","year":2022},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:4ce9d35f8066fb6a09f285deb5a51b84f7897953ab252b9e10ca1095880467a0","observation_id":"4c7212c8-ce2c-4bfe-ad97-64d03a7591fe","resolution":{"observed_at":"2026-05-20T17:46:47.156478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"4e8ecef6-ef47-4f2d-b005-41b9c5b2ee7a","year":2022},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:62be53a12db364384d326ffe9b72045f599ab13299bf58aea5d98cc4bb8ec470","observation_id":"3e97ef45-e45d-4dbb-9eb4-0740bf12510c","resolution":{"observed_at":"2026-05-20T17:46:47.158934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5877f90f-41d7-45f2-8ca9-defcface6451","year":null},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:22f661d6dcc1a7468a932ea728249164da0636e2c26b3f66fc3576b058ef89f4","observation_id":"a103feb3-6537-434d-a102-6cc74e136430","resolution":{"observed_at":"2026-05-20T17:46:47.161618Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"31d7e11c-b741-4424-84c4-5812235863c6","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:25b0dbe6bca18dfd5c1f549d238ffefbce10c935de85802d4e03a2052e9dfc78","observation_id":"30573f5f-c1b7-4739-8ddc-f7378b08a5d3","resolution":{"observed_at":"2026-05-20T17:46:47.164783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14489","last_updated":"2024-01-30T21:26:09Z","snapshot_observed_at":"2026-07-06T17:20:37.280501Z","submitted_at":"2024-01-25T19:50:31Z","title":"The Case for Co-Designing Model Architectures with Hardware","version":2},"cited_work":{"arxiv_id":"2401.14489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.14489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3cd53c0a-ff30-4e81-91ec-19ab29c8c389","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2401.14489","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:1ae71a971f338550c5d0a7b9cbc8d7e2b213112ea341f4b2448ddfe5a7914b65","observation_id":"1caf2a2f-444a-4beb-aac8-736186efbcc2","resolution":{"observed_at":"2026-05-20T17:46:47.124760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08475","last_updated":"2020-12-31T07:58:30Z","snapshot_observed_at":"2026-07-06T08:30:35.722297Z","submitted_at":"2019-10-18T15:35:59Z","title":"On Warm-Starting Neural Network Training","version":3},"cited_work":{"arxiv_id":"1910.08475","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.08475","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"com/abstract=655541","venue":null,"work_id":"cd7a1347-4b68-40a5-b08a-b424d5be0029","year":1910},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/1910.08475","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:a4fd49df8172e71748f489d7501129d1181a13938423092da67bf35f4362762b","observation_id":"2d31d695-1fb2-4823-89de-dfcc0dc71dd4","resolution":{"observed_at":"2026-05-20T17:46:47.127657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-07-10T20:57:35.014119Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:5ee9967dcdeaf3871829c25a36b0d24463cd2528e7116b344c931f86605b35c3","observation_id":"acaf7ac9-2b37-4e6d-9ba2-21d39af9c503","resolution":{"observed_at":"2026-05-20T17:46:46.985455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":"1611.09268","doi":"10.48550/arxiv.1611.09268","metadata_source":"pith","pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","venue":"cs.CL","work_id":"78d498ce-11db-4f88-8eb0-40e0f86af615","year":2016},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6f3868af93fde1a0ebdf110628b75840e650e88bffdf00678d3a83854cb7a198","observation_id":"29452e59-f398-479e-9f40-b9945ea891cb","resolution":{"observed_at":"2026-05-20T17:46:46.989758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-06-02T00:57:40.781479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-02T00:57:40.781479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-07-11T03:27:46.681766Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:878ca89d9ec072139b40d9e361b2e4232ec8b72f5f576dd68914d8e1cbc9234e","observation_id":"cb4f5500-587a-4cbb-a333-b0f774f270b9","resolution":{"observed_at":"2026-05-20T17:46:47.003273Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"788b47d6-aea2-4874-a8c6-dedeb385636a","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:acdb23b6dd5ed9a3742402c097aaba3fca5eea291318a1d6091dc5d4282bd635","observation_id":"9f1ba77b-b20a-4aae-99f4-361c72235d75","resolution":{"observed_at":"2026-05-20T17:46:47.167532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"77b1cc92-2e82-4b5c-a190-82674856a114","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:8ff3a2a3759d75b63413712120b8baee976fedcdb57988d317e39c5c3ed33bf6","observation_id":"7026d7f0-2d5e-4bfa-bbec-2c13e4db05fc","resolution":{"observed_at":"2026-05-20T17:46:47.169877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"01dfbc28-cb5f-4395-b50c-692d20707e0c","year":2022},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:ef9478c7f596e939af06e3fa81c721d85eb09ea214e70565c320e24a8a6ba4f7","observation_id":"28a3fe9a-54cc-4570-adcf-576dbabcd12c","resolution":{"observed_at":"2026-05-20T17:46:47.172166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e761aa85-d62e-4026-9728-311cf6ab6823","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:7cf1ad5c818cc6405b9475cbbfc4e0892344ddcb16e8aa7b8ce02dc8c54cd571","observation_id":"8b99a71c-f922-43b2-9e2e-ec2ad3414c86","resolution":{"observed_at":"2026-05-20T17:46:47.175103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1544b45d-1b0a-4bf8-a601-a0108a7f1f45","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:d98058ea82dba173e13bcea816709b8a2cd34bf94fa19060080750e34e139bac","observation_id":"973f6bee-d7ae-4f4f-9826-b708a3fa61d7","resolution":{"observed_at":"2026-05-20T17:46:47.177125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.137","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T19:17:17.447107Z","title":"M 3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","venue":"Findings of the Association for Computational Linguistics ACL 2024","work_id":"6f249b44-4b0a-47dd-b5f4-1877fd9269ad","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6e8b64b5cf96c49130f1151627c13ffe85c9229883ac7b4de76265bc06d431ba","observation_id":"e5c68044-deff-450c-8493-8ff92579fa12","resolution":{"observed_at":"2026-05-20T17:46:46.930204Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-12T15:19:19.048621+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T15:19:19.048621+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4c4db4b8-f4db-4c9f-8949-3468d1f0b56b","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:869f055753e71e95779c9ac3e0b033c3397be7d42cec194b781046c8398c9f1d","observation_id":"77a92609-eed2-413d-9815-57e84cb34e2e","resolution":{"observed_at":"2026-05-20T17:46:47.262412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Le, and Christopher D","venue":null,"work_id":"2ba3b167-5cf6-4376-8f17-c4b4d2000855","year":2020},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:bf644e0f4c1b3cd351cc1b5ab1cf226ea3c1f98ac8d00d6e97281b4290ff2899","observation_id":"9f82be68-63f1-4196-b0d2-7ee723af6a16","resolution":{"observed_at":"2026-05-20T17:46:47.182674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20750","last_updated":"2024-07-30T11:42:19Z","snapshot_observed_at":"2026-08-03T19:36:21.202564Z","submitted_at":"2024-07-30T11:42:19Z","title":"JaColBERTv2.5: Optimising Multi-Vector Retrievers to Create State-of-the-Art Japanese Retrievers with Constrained Resources","version":1},"cited_work":{"arxiv_id":"2407.20750","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.20750","snapshot_observed_at":"2026-07-02T15:17:07.538450Z","title":null,"venue":null,"work_id":"c597ed4f-0cbd-4a11-ad56-1380543858b1","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2407.20750","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:3e9e3240c497c41e4482eba4d2a554deedeecc9d151627ada918bafbfe2ede93","observation_id":"f324e578-7512-4c87-9cc1-128ff1f9ea02","resolution":{"observed_at":"2026-05-20T17:46:47.145882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"049d5de1-508c-48fe-939e-8c3c78eaac6f","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:862465fb15286f16ddfb1a05d5213553ae4a2c4c92cd396369660b33c0ab0cfc","observation_id":"c33e2abf-3732-4cf1-8627-28a54c11087e","resolution":{"observed_at":"2026-05-20T17:46:47.184955Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T16:42:40.321299Z","title":null,"venue":null,"work_id":"272a56cc-b6fa-451b-8352-cd7fba69289f","year":2022},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:fa0ec7b1045c70b7374878af4bacd941f30f7217a185d7a52bc7c98ce2d20ec6","observation_id":"3e84a629-79f3-429c-89cf-d196e044eef7","resolution":{"observed_at":"2026-05-20T17:46:47.187028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dauphin, Angela Fan, Michael Auli, and David Grangier","venue":null,"work_id":"5980086f-46a7-471d-975d-9ce49acfa2fe","year":2017},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":131,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6f981ac93b662ffa421da6ebd062f71587d3f78b2c8f7bdacbe38e1118a33aff","observation_id":"f651ba17-488f-4893-854f-8e37dcb144df","resolution":{"observed_at":"2026-05-20T17:46:47.189491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.5146400","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"76a48dcc-be2c-4b15-a1e1-6b3fa6a56c72","year":2021},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:1add3eb319f4be734ac1abf8877537379819f530655792f3f72285471d796a80","observation_id":"0a0b76e1-df62-4af9-bc1d-ef6249e6fc1f","resolution":{"observed_at":"2026-05-20T17:46:46.941900Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1423","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:27:44.847366Z","title":"BERT : Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"Proceedings of the 2019 Conference of the North","work_id":"3e3c8ac8-b858-4b22-af32-393d98c883e0","year":2019},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:21ccc176230b15105eee97854af0f77070d7f5cfded44a209ad8d936d846f914","observation_id":"39fc5d7a-db5a-47a5-a806-47f4548dc507","resolution":{"observed_at":"2026-05-20T17:46:46.945500Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T13:38:13.85894+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T13:38:13.85894+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":134,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:2a0886da9b40084b29771f85661a8e4029967999779550e16a48057e18c1b06e","observation_id":"8b435a2e-da81-4fd5-a6c4-29991917b6a1","resolution":{"observed_at":"2026-05-20T17:46:47.022153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10171","last_updated":"2024-02-15T18:19:16Z","snapshot_observed_at":"2026-08-03T09:02:39.861878Z","submitted_at":"2024-02-15T18:19:16Z","title":"Data Engineering for Scaling Language Models to 128K Context","version":1},"cited_work":{"arxiv_id":"2402.10171","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10171","snapshot_observed_at":"2026-07-10T20:07:33.537106Z","title":"Data engineering for scaling language models to 128k context.arXiv preprint arXiv:2402.10171","venue":"cs.CL","work_id":"3416cc4a-8e98-4b89-a696-760e86f3c718","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2402.10171","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:b2bc7c519074b4ce2ef893744f3255d060ff718077f62974a3f5a996b805669c","observation_id":"7664ed1c-a9c6-4c5d-892f-bf13a0359881","resolution":{"observed_at":"2026-05-20T17:46:47.037769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.12009","last_updated":"2019-07-28T03:57:41Z","snapshot_observed_at":"2026-07-06T08:10:42.792778Z","submitted_at":"2019-07-28T03:57:41Z","title":"Representation Degeneration Problem in Training Natural Language Generation Models","version":1},"cited_work":{"arxiv_id":"1907.12009","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.12009","snapshot_observed_at":"2026-07-04T08:19:44.366737Z","title":"Representation degeneration problem in training natural language generation models","venue":null,"work_id":"ab884c15-10ec-4ada-a791-74ccb3e6de3a","year":2019},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/1907.12009","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:78af74a0c79b6ee2d9689e575bdf3abefe13d5f64f3537683e2327a69851d175","observation_id":"d1c43f97-007f-4651-8943-3a54b89bda33","resolution":{"observed_at":"2026-05-20T17:46:47.049310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.02660","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T18:40:03.208056Z","title":"How to train long- context language models (effectively)","venue":null,"work_id":"1a93fc7f-b292-4ad8-b303-698846cc45a6","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:cc1df61c4f2a77ea5cf42e6cd5338d5b3b940d56a754f04e93f4c97630c98b1c","observation_id":"99d7b252-e25c-437d-b16c-8243ef8da04a","resolution":{"observed_at":"2026-05-20T17:46:47.060444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"108cd17e-e0c6-4053-93cf-faea1ac61554","year":2023},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:ceac499c96fac9470b1416d0a2b830e051e40902cdbfe61b8cfc658f020107f9","observation_id":"b78c3eec-0f87-4e28-bf26-2e8a30eaaab5","resolution":{"observed_at":"2026-05-20T17:46:47.191747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:e6a396e99e0a1f6fb3f6a290a3e97c5b79f79cfa52a66cd4c95d22490453cf44","observation_id":"bcc50f09-23f8-4a6a-b9fa-82ed72d81297","resolution":{"observed_at":"2026-05-20T17:46:47.077697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":1,"unresolved":14,"verified_exact":15,"verified_fuzzy":66},"total_outbound_references":172},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 172 outbound references and 61 inbound Pith citation observations for arXiv:2412.13663."}