{"as_of":"2026-08-08T07:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bac34fb801f0f356d8a8752eb5c3e4519b656cf6fa7dbc52ae43eea9dcac1ce","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:17:24.839680Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19472/citation-record","integrity":"/paper/2505.19472/integrity","json":"/paper/2505.19472/citation-record.json","paper":"/paper/2505.19472"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T14:17:23.520664Z","title":"Phi-3 technical report: A highly capable language model locally on your phone.arXiv preprint arXiv:2404.14219,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.520664Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:78dc6d2061ae73b36e1878f9afc6f5764868f07e087591efee2e1097f6788792","observation_id":"a7279278-0e48-4015-aaed-be29ce74d873","resolution":{"observed_at":"2026-08-07T14:17:23.520664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14052","last_updated":"2023-04-29T03:18:40Z","snapshot_observed_at":"2026-08-06T18:01:24.576458Z","submitted_at":"2022-12-28T17:56:03Z","title":"Hungry Hungry Hippos: Towards Language Modeling with State Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14052","snapshot_observed_at":"2026-08-07T14:17:23.744022Z","title":"Hungry hungry hippos: Towards language modeling with state space models.arXiv preprint arXiv:2212.14052,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.744022Z"},"links":{"cited_paper":"/paper/2212.14052","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:bd769ef19e901066e863b434d250f8e6566ff4545f25ed430f85a1cb9b34dded","observation_id":"3df97dfd-3053-4c74-bb2c-37ca105293cb","resolution":{"observed_at":"2026-08-07T14:17:23.744022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-07T14:17:23.971734Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.971734Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:ea5a58ae5b201e8c6845e08fc27a3149afb61b28adb0a3612ec5f9512e3cf45f","observation_id":"2803124a-5e76-452e-b177-255c78c8e63f","resolution":{"observed_at":"2026-08-07T14:17:23.971734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16300","last_updated":"2023-11-20T01:16:17Z","snapshot_observed_at":"2026-08-04T15:01:39.394740Z","submitted_at":"2023-05-25T17:53:42Z","title":"Landmark Attention: Random-Access Infinite Context Length for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16300","snapshot_observed_at":"2026-08-07T14:17:24.269674Z","title":"Landmark attention: Random-access infinite context length for transformers.arXiv preprint arXiv:2305.16300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.269674Z"},"links":{"cited_paper":"/paper/2305.16300","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:04a0daf2ab6040ef95818720c51cf76ccb8a3ef0e5c9c97b5f9066cbff6b4340","observation_id":"844da00b-9e6d-42e3-b7b0-16ff33187d6c","resolution":{"observed_at":"2026-08-07T14:17:24.269674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04248","last_updated":"2024-04-25T17:01:52Z","snapshot_observed_at":"2026-08-01T22:35:09.645916Z","submitted_at":"2024-02-06T18:56:35Z","title":"Can Mamba Learn How to Learn? A Comparative Study on In-Context Learning Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04248","snapshot_observed_at":"2026-08-07T14:17:24.359568Z","title":"Can mamba learn how to learn? a comparative study on in-context learning tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.359568Z"},"links":{"cited_paper":"/paper/2402.04248","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:0fb1052bc32bbef3efea8cb7783e53726c3c1dbc745d4193a66dbe17f2a60eb2","observation_id":"5d8e934f-4a6f-4c4f-ac4a-a310580b8552","resolution":{"observed_at":"2026-08-07T14:17:24.359568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-07T14:17:24.438171Z","title":"Rwkv: Reinventing rnns for the transformer era.arXiv preprint arXiv:2305.13048,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.438171Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:a80105e7ee4fa20856fb777e56f0df27798c796e395c804e05c63e70c0ff3a66","observation_id":"1466c386-e7ad-4c74-87d5-4fe7c6d92ae1","resolution":{"observed_at":"2026-08-07T14:17:24.438171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07522","last_updated":"2025-02-28T02:20:49Z","snapshot_observed_at":"2026-08-06T19:04:16.718797Z","submitted_at":"2024-06-11T17:50:51Z","title":"Samba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07522","snapshot_observed_at":"2026-08-07T14:17:24.526655Z","title":"Samba: Simple hybrid state space models for efficient unlimited context language modeling.arXiv preprint arXiv:2406.07522,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.526655Z"},"links":{"cited_paper":"/paper/2406.07522","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:ba23a99c8fbc3c6c67f97659cc19b3d316d70fc5865fabece76ae8c3844d863c","observation_id":"4666ba30-0ddc-4635-8118-c16861fce410","resolution":{"observed_at":"2026-08-07T14:17:24.526655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12570","last_updated":"2024-08-22T17:38:59Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:38:59Z","title":"Jamba-1.5: Hybrid Transformer-Mamba Models at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12570","snapshot_observed_at":"2026-08-07T14:17:24.615532Z","title":"Jamba Team, Barak Lenz, Alan Arazi, Amir Bergman, Avshalom Manevich, Barak Peleg, Ben Aviram, Chen Almagor, Clara Fridman, Dan Padnos, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.615532Z"},"links":{"cited_paper":"/paper/2408.12570","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:7bbb89b5d3e77e949d2f9d69224ce584b795802b210bf89fdaa0cc6f4628489b","observation_id":"5df5c35c-815f-4955-8689-579185a4523d","resolution":{"observed_at":"2026-08-07T14:17:24.615532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06635","last_updated":"2024-08-27T01:27:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-11T18:51:59Z","title":"Gated Linear Attention Transformers with Hardware-Efficient Training","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06635","snapshot_observed_at":"2026-08-07T14:17:24.707153Z","title":"Gated linear attention transformers with hardware-efficient training.arXiv preprint arXiv:2312.06635,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.707153Z"},"links":{"cited_paper":"/paper/2312.06635","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:e1f59a24f20e0b175ad67d5ec5942f7b37bb07e20d8802ff21d1ac4bb44019be","observation_id":"8cad88c7-8ce7-4865-b85a-1e2dd8b1f83c","resolution":{"observed_at":"2026-08-07T14:17:24.707153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14577","last_updated":"2025-04-01T04:41:35Z","snapshot_observed_at":"2026-07-06T20:25:40.715105Z","submitted_at":"2025-01-24T15:33:05Z","title":"ZETA: Leveraging Z-order Curves for Efficient Top-k Attention","version":3},"cited_work":{"arxiv_id":"2501.14577","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.14577","snapshot_observed_at":"2026-08-07T14:17:24.979226Z","title":"ZETA: Leveraging Z-order Curves for Efficient Top-k Attention","venue":"cs.LG","work_id":"da20fce6-42c2-4fc4-bb89-1c0bfd8fa45c","year":2025},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.839680Z"},"links":{"cited_paper":"/paper/2501.14577","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:df4e72781b18782b14e0c4509f175def9dff260636c85d168a79abe04eb35ebf","observation_id":"e8f6c4f5-bb6e-4934-8889-7970166d0265","resolution":{"observed_at":"2026-08-07T14:17:25.063174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-07T14:17:24.172253Z","title":"Jamba: A hybrid transformer-mamba language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.172253Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:c43630353f313ad36660104659e1e854ea0abde51de07ee38bd492a3ba49b918","observation_id":"a477360e-5afc-42cf-a9ef-04651aab6cea","resolution":{"observed_at":"2026-08-07T14:17:24.172253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16605","last_updated":"2024-12-02T08:41:46Z","snapshot_observed_at":"2026-07-06T18:20:09.790181Z","submitted_at":"2024-05-26T15:31:09Z","title":"Demystify Mamba in Vision: A Linear Attention Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16605","snapshot_observed_at":"2026-08-07T14:17:24.067573Z","title":"Bridging the divide: Reconsidering softmax and linear attention.Advances in Neural Information Processing Systems, 37:79221–79245, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.067573Z"},"links":{"cited_paper":"/paper/2405.16605","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:4eb7a9eb3fe74c0ccf5a2ed3b12d437ca2d801e20255aad816e330be088f9def","observation_id":"da5afdcc-5471-4a1f-940f-938756a61054","resolution":{"observed_at":"2026-08-07T14:17:24.067573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T14:17:23.879566Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.arXiv preprint arXiv:2312.00752,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.879566Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:dc1514337c18fb5fe2cd2e0a9782accde10a2a45ec8a4494a7048b6f32d58e08","observation_id":"e7cd4254-4cc9-4513-9d29-306d0bffa5ef","resolution":{"observed_at":"2026-08-07T14:17:23.879566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-07T14:17:23.586770Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality.arXiv preprint arXiv:2405.21060,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.586770Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:f742a9b6fbb0b9101cdc6703acafc9fdc333c061c42c29e0d6bfd0048e9d964b","observation_id":"811a9032-c5e1-4f61-939f-8e558e124d0e","resolution":{"observed_at":"2026-08-07T14:17:23.586770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13676","last_updated":"2024-11-20T19:51:25Z","snapshot_observed_at":"2026-08-02T12:55:25.835610Z","submitted_at":"2024-11-20T19:51:25Z","title":"Hymba: A Hybrid-head Architecture for Small Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13676","snapshot_observed_at":"2026-08-07T14:17:23.650165Z","title":"Hymba: A hybrid-head architecture for small language models.arXiv preprint arXiv:2411.13676,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.650165Z"},"links":{"cited_paper":"/paper/2411.13676","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:a58e781c59ae4ab9b7b9814386e28b672a8a0f0d555c16a5911e2c1d29c2da6d","observation_id":"82ae23a5-1ebd-4d31-bb29-1c836f3c8e44","resolution":{"observed_at":"2026-08-07T14:17:23.650165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:11:21.964318Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2505.19472."}