{"as_of":"2026-08-13T01:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3dc254c91126d372bf9bc6a7687372072ebd4cd2b66d81ebc163ff6bcc31662","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:00:08.776106Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.13050/citation-record","integrity":"/paper/2411.13050/integrity","json":"/paper/2411.13050/citation-record.json","paper":"/paper/2411.13050"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.273408Z","title":"ReTransformer: ReRAM-based processing-in-memory architecture for transformer acceleration,","venue":null,"work_id":"86249d6b-de6f-4d8f-8d9e-febda432f97f","year":2020},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.641024Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:6937c671c92f5ac59d3a8900c339ed90bf1a1ddd3b9d9905940067fe267db8c6","observation_id":"d5beb75b-a4ae-466c-8e88-3b1c90ca93c1","resolution":{"observed_at":"2026-08-12T17:00:09.279000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.254360Z","title":"Spatten: Efficient sparse attention architecture with cascade token and head pruning,","venue":null,"work_id":"0666e867-3c94-477b-b172-40ad57a3dedf","year":2021},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.648001Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:0fb0e708cbfcf1a12407dd876bf008324dc1388112f3ffd995bf32a1f40cc96b","observation_id":"05a35039-d8bb-4b0b-af30-b03dcbfcc846","resolution":{"observed_at":"2026-08-12T17:00:09.260413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.229729Z","title":"A length adaptive algorithm-hardware co-design of transformer on fpga through sparse attention and dynamic pipelining,","venue":null,"work_id":"2b5fb2f1-60f4-46f1-9a31-9f462b0a8899","year":2022},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.654090Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:5f0f33a96266e4da03be74cc7a87f172cedd7b5e66b60c0292137d45302d58e6","observation_id":"d5ee5cd9-a46f-46fd-84fd-580934c82eb6","resolution":{"observed_at":"2026-08-12T17:00:09.235264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.212811Z","title":"X-former: In- memory acceleration of transformers,","venue":null,"work_id":"11a88ceb-2645-499e-adea-eb48dcffd376","year":2023},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.660407Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:a640efc18d2a047055be2e3e769dd35bd4850e23a703047e621fa7fc4a3f1eda","observation_id":"ec57079f-03c7-4621-842a-c21fe309cdae","resolution":{"observed_at":"2026-08-12T17:00:09.217978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.195491Z","title":"DNN+ NeuroSim V2. 0: An end-to-end benchmarking framework for compute-in-memory accelerators for on-chip training,","venue":null,"work_id":"9a64cb11-3614-4ea9-b491-d03fcac3da75","year":2020},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.666207Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:ab9d1ed3967b8580ec19fe924e1baaab65358489dafd2918e2dcb644c71e4ef6","observation_id":"09a3ee38-d53c-4b1b-a954-7ba1408e22c3","resolution":{"observed_at":"2026-08-12T17:00:09.200910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.177190Z","title":"A 16K current- based 8T SRAM compute-in-memory macro with decoupled read/write and 1-5bit column ADC,","venue":null,"work_id":"5d4d5373-71f2-4bdb-a706-542bd105b19c","year":2020},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.672956Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:deb2998761ab0beda586f481c0f3deed29019f5364b9c7928f8a823d36734601","observation_id":"9c44c675-dbd7-4906-9637-7fed633daee7","resolution":{"observed_at":"2026-08-12T17:00:09.183539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.157332Z","title":"Softermax: Hardware/software co-design of an efficient softmax for transformers,","venue":null,"work_id":"5ef601ed-0f7f-4088-8e6a-b06f4835b350","year":2021},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.682177Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:35fdee6430710ba653b30b74861afb6753a53db9946f3897b5a17a70622bddfe","observation_id":"e32f0d14-afd0-484d-aa4b-016b36a49460","resolution":{"observed_at":"2026-08-12T17:00:09.164192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.138720Z","title":"Base-2 softmax function: Suitability for training and efficient hardware implementation,","venue":null,"work_id":"665249d6-de1a-4302-95b9-65e69420dde6","year":2022},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.688828Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:2489b209a5efb8fb4ebf80cfa71353b4798231f3b548f7a10582e1cacfd482b1","observation_id":"3434807a-f742-4b0b-99db-81f0702df82e","resolution":{"observed_at":"2026-08-12T17:00:09.144265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.120447Z","title":"Hardware implementation of the exponential function using Taylor series,","venue":null,"work_id":"e7b95572-cedb-4c44-86e6-5c42c8f67c08","year":2014},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.694462Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:07471a241cb482954b27bc5f4d44605b275a24240a9b72a926c07b8aa6ad6437","observation_id":"f3c96f54-3684-49a3-9264-85abc125bdb7","resolution":{"observed_at":"2026-08-12T17:00:09.126194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.096577Z","title":"On the Computational Power of Winner-Take-All,","venue":null,"work_id":"01ec9396-1298-4516-88a5-3dd530b4d29b","year":2000},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.699897Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:080267900c86b39f6b9b4c21ece7b5dc54ddb78539c032838579b36affbef07a","observation_id":"7addbd61-8e0a-410f-a505-3bb78769c15e","resolution":{"observed_at":"2026-08-12T17:00:09.105269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.076829Z","title":"Vitality: Unifying low-rank and sparse approximation for vision transformer acceleration with a linear taylor attention,","venue":null,"work_id":"1fb3b446-7b0a-4481-a295-82d23c9e1bab","year":2023},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.705387Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:062b8e8d61630d61d7513fef36e59eebe98381ddf4cdcaaaae3b63f8318f99bf","observation_id":"b323bf25-0ab8-4c0c-809f-ad597ae93136","resolution":{"observed_at":"2026-08-12T17:00:09.083674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.054757Z","title":"I-bert: Integer- only bert quantization,","venue":null,"work_id":"53f502d9-4e69-45c8-bb56-d776463c07da","year":2021},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.711349Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:e8b7d7e8e79416bfe084417d72c2e0f67c929eae7bfbd129543ba9e433a76856","observation_id":"e9981a9e-0d3d-41be-827c-d58ca5e0799f","resolution":{"observed_at":"2026-08-12T17:00:09.061394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.030538Z","title":"Efficient softmax hardware architecture for deep neural networks,","venue":null,"work_id":"f9101221-41b7-476e-8cd5-165279c22256","year":2019},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.716543Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:d618ae3f6229259bcde4aa60bb57ff53c90c261702da5fc0097f93b6b61d737b","observation_id":"b4b819c0-3f10-4601-831f-f17159667240","resolution":{"observed_at":"2026-08-12T17:00:09.038840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:09.005994Z","title":"TranCIM: Full- digital bitline-transpose CIM-based sparse transformer accelerator with pipeline/parallel reconfigurable modes,","venue":null,"work_id":"b571e242-b88a-4c8c-a1dd-61369f7d3797","year":2022},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.722263Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:3a8ea68af1ca64bc076ebc8d9377e4eacaba1b66d7b4a45214b38e739661482c","observation_id":"28ff3607-11eb-47e3-8186-6e24b9f0c5fc","resolution":{"observed_at":"2026-08-12T17:00:09.014896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.982703Z","title":"Challenges and trends of SRAM-based computing-in-memory for AI edge devices,","venue":null,"work_id":"63732ce3-af0a-4d13-9e0f-4d8756a30872","year":2021},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.727676Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:e685dffeeacf59f2f3ca596fabebb60663540b7c07c1bb98bf0e8b847132d31a","observation_id":"f6e8666b-caeb-477c-b886-41659b8a04c9","resolution":{"observed_at":"2026-08-12T17:00:08.988769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.962723Z","title":"A 240×180 130 db 3 µs latency global shutter spatiotemporal vision sensor,","venue":null,"work_id":"acfebe99-e035-461d-b046-30bf1fa1d19e","year":2014},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.734687Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:a8155bce4c950f5ab274abc59808bc682412014449579e3762741966e0e4d3e2","observation_id":"32adab4c-4da4-4659-a4ff-5667ad5bcc13","resolution":{"observed_at":"2026-08-12T17:00:08.968599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.943779Z","title":"Hardware-aware softmax approximation for deep neural networks,","venue":null,"work_id":"319e064a-a5de-4276-b066-2d3439341e33","year":2019},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.740788Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:4d9d6d0216cea235f80742482fcd579bad5e82da6622856a2cca58b04862f3b4","observation_id":"4bc3ae42-b785-4323-a7e3-ecc091a97d89","resolution":{"observed_at":"2026-08-12T17:00:08.949930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.922580Z","title":"Memristor-based edge computing of blaze block for image recognition,","venue":null,"work_id":"6187460e-c040-4c3c-823e-2041986014a6","year":2020},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.747080Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:c7f70b69ffdf688041508a3ab12be132d788469162a5c4fff234535ae160de37","observation_id":"0b0a0c90-c364-4d71-830b-661cbcbc4b34","resolution":{"observed_at":"2026-08-12T17:00:08.929432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.900353Z","title":"19.7 A 16Gb ReRAM with 200MB/s write and 1GB/s read in 27nm technology,","venue":null,"work_id":"4f68ac8b-6da5-4f80-a8fa-281a7d4cf26c","year":2014},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.752500Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:4dec76fdd067819211c9df59f9d7610a3fab8bcd60f296f550e9c0058de10c47","observation_id":"751eeaba-c043-47ba-b9af-387b5a77607d","resolution":{"observed_at":"2026-08-12T17:00:08.906167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.878311Z","title":"90 nm 32×32 bit Tunneling SRAM Memory Array With 0.5 ns Write Access Time, 1 ns Read Access Time and 0.5 V Operation,","venue":null,"work_id":"3a4a8da7-c59f-4c40-aaca-9b5cc3eeaa68","year":2011},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.757810Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:7e0569fd0f251e1cf0ca619a37792f033c02c0b633ae9c9b3d4012c04c86f946","observation_id":"534a638a-a083-4fb3-8227-a8ac52f101c9","resolution":{"observed_at":"2026-08-12T17:00:08.885306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.857771Z","title":"Tron: Transformer neural network acceleration with non-coherent silicon photonics,","venue":null,"work_id":"d5489677-f819-43a0-9af4-90fa97fa398c","year":2023},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.763873Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:cc73aed011a6b7358e406736c9a09e3e7795d47967a9b7fce19043aa432746fc","observation_id":"c1fdb7c5-e56a-45ac-9a88-ebcc738b5a30","resolution":{"observed_at":"2026-08-12T17:00:08.863894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.837404Z","title":"ELSA: Hardware-software co-design for efficient, lightweight self-attention mechanism in neural networks,","venue":null,"work_id":"34026b66-917e-4bcc-8d67-f8dac11c2ac5","year":2021},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.770104Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:d55db5f164071a4d83bccd436e5126a9ea84b23bc29a4f55f66b7a24f82c39e3","observation_id":"ca4cc5dd-416e-4ca3-894f-f142ce63a8f5","resolution":{"observed_at":"2026-08-12T17:00:08.843300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:08.814701Z","title":"Hardsea: Hybrid analog-reram clustering and digital-sram in-memory computing accelera- tor for dynamic sparse self-attention in transformer,","venue":null,"work_id":"76b287d2-0807-4ef7-bfdb-c0685d5bc339","year":2023},"citing_paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:08.776106Z"},"links":{"citing_paper":"/paper/2411.13050"},"observation_digest":"sha256:493c8cb5d249e325df81627142c71bc338679980bfdc287f0072e52f9ecb2fb4","observation_id":"d09f5fb0-ff5b-4cd0-b045-cec722b13f3e","resolution":{"observed_at":"2026-08-12T17:00:08.822501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.13050","last_updated":"2024-11-20T05:51:35Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-12T16:51:02.178307Z","submitted_at":"2024-11-20T05:51:35Z","title":"Topkima-Former: Low-energy, Low-Latency Inference for Transformers using top-k In-memory ADC"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2411.13050."}