Pith. sign in

URL https://aclanthology.org/2025.acl-long.1126/

8 Pith papers cite this work, alongside 41 external citations. Polarity classification is still indexing.

8 Pith papers citing it
41 external citations · OpenAlex

citation-role summary

dataset 1

citation-polarity summary

years

2026 8

roles

dataset 1

polarities

use dataset 1

representative citing papers

Efficient Pre-Training with Token Superposition

cs.CL · 2026-05-07 · unverdicted · novelty 5.0 · 2 refs

Token-Superposition Training combines multiple tokens into bags for multi-hot cross-entropy pre-training followed by a recovery phase, yielding up to 2.5x reduction in training time at 10B scale under equal-loss conditions.

BFLA: Block-Filtered Long-Context Attention Mechanism

eess.SP · 2026-05-12 · unverdicted · novelty 4.0

BFLA is a two-stage block-filtered sparse prefill attention mechanism that constructs an input-dependent block mask and applies tile-level rescues to skip unimportant KV tiles while preserving exact attention inside retained tiles, delivering speedups on models like Llama 3.1 with minimal accuracy 0

citing papers explorer

Showing 8 of 8 citing papers.