{"as_of":"2026-07-25T01:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:820fab35a6c4611387943001b6d6e2f83de5d00be7a88ce3994e7c57af9dc330","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T10:12:35.951089Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-24T06:31:00.690269+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T10:12:35.951089Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-16T10:12:43.035170Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"cited_work":{"arxiv_id":"2601.21503","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.21503","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","venue":"cs.AI","work_id":"c526cc7e-7a83-46c9-8cc5-72d457fd3e6e","year":2026},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2601.21503","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:0bb4c0d34ca119a948fe245494bdd148da9f349c49ac5f15a11a04f55456e74d","observation_id":"b6c36d28-c5ef-4281-b1ab-3cccada53fa2","resolution":{"observed_at":"2026-05-16T10:12:43.037581Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.21503/citation-record","integrity":"/paper/2601.21503/integrity","json":"/paper/2601.21503/citation-record.json","paper":"/paper/2601.21503"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"cited_work":{"arxiv_id":"2601.21503","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.21503","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","venue":"cs.AI","work_id":"c526cc7e-7a83-46c9-8cc5-72d457fd3e6e","year":2026},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2601.21503","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:0bb4c0d34ca119a948fe245494bdd148da9f349c49ac5f15a11a04f55456e74d","observation_id":"b6c36d28-c5ef-4281-b1ab-3cccada53fa2","resolution":{"observed_at":"2026-05-16T10:12:43.037581Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20b441d8-5b80-46e0-b4aa-1c19ee70fbdf","year":null},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:b1570618f689ff519af7aa61a91cbde21af88899fd734b3e8fd672ac84076066","observation_id":"6d2fea0b-4b34-4c8b-9f12-bc079eeeae48","resolution":{"observed_at":"2026-05-16T10:12:43.144007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data and experimental settings We use Llamba-1B, the Mamba variant of LLaMA-3.2-1B, as the starting point for the second stage of the MAR framework","venue":null,"work_id":"6aad17be-dbe1-4003-ac39-8c7d8a39d952","year":2000},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:461b6c3ff4126ecdce242d8e2129815d9e4b45f5c8938b8427fc97a9d1b4223d","observation_id":"b42b4323-5b85-4bb9-ba5f-2d70f4926953","resolution":{"observed_at":"2026-05-16T10:12:43.138779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In the first stage, SSMs are introduced to achieve linear-time sequence modeling; in the sec- ond, activation spiking is applied to reduce the computational cost of FFNs","venue":null,"work_id":"96e1cb6a-6c32-4d2c-a7b9-1859c7a0a9c1","year":null},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:c4e5c75ff208f53d75008bde85d63a62c5b193aaea5be2dd48331aeae0473c6a","observation_id":"2051fa14-2b0d-44e7-9bcf-a9600637b9b8","resolution":{"observed_at":"2026-05-16T10:12:43.130828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-11T03:47:48.508181Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:e4990ccda21bda85939ba67b4ede19b9974200c4c6b790ceb3d46e0325cec634","observation_id":"b0a63496-7ce3-4682-a028-7db113e7ead0","resolution":{"observed_at":"2026-05-16T10:12:42.991859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:41.000069+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:41.000069+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:d87ad093eed9f2f48a860551363f1631b2462d1e9ec0ed962e19fe9a1dab6e90","observation_id":"7c711df8-92a9-48bd-aea8-d92dccd595c0","resolution":{"observed_at":"2026-05-16T10:12:43.045827Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:f8239a76cc8cf14bafe441164e1d71c5ac42c292edfea5ce374cd7b189a521a8","observation_id":"0172d989-17d1-4603-a04c-08b78ed49957","resolution":{"observed_at":"2026-05-16T10:12:42.999801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15062","last_updated":"2023-10-14T02:14:51Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T11:52:07Z","title":"Lawyer LLaMA Technical Report","version":2},"cited_work":{"arxiv_id":"2305.15062","doi":"10.48550/arxiv.2305.15062","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15062","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Lawyer llama technical report","venue":null,"work_id":"f43e580f-aa48-4b6f-9692-372cd30cf41b","year":2023},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2305.15062","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:38fdabd4122b62c9eb4941b6a0df06d21db6c786fe0c5ad33ae14f768f696fda","observation_id":"409e4ccd-e82e-41cf-bc7a-dd3c5b01e777","resolution":{"observed_at":"2026-05-16T10:12:43.010647Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14201","last_updated":"2023-05-23T16:20:30Z","snapshot_observed_at":"2026-07-06T15:31:36.425535Z","submitted_at":"2023-05-23T16:20:30Z","title":"Goat: Fine-tuned LLaMA Outperforms GPT-4 on Arithmetic Tasks","version":1},"cited_work":{"arxiv_id":"2305.14201","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.14201","snapshot_observed_at":"2026-07-04T20:30:07.307584Z","title":"arXiv preprint arXiv:2305.14201 , year=","venue":null,"work_id":"509b3a93-b413-4e4d-9a0f-6a64a42f646b","year":2020},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2305.14201","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:0167741296242d729f253c645bc4d32f41ef2d46d84ffbd87e7b3ccc51c075fc","observation_id":"56845ef4-9282-4c5e-914d-099aa6a4a954","resolution":{"observed_at":"2026-05-16T10:12:43.015746Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Mamba in the Llama: Distilling and accelerating hybrid models","venue":null,"work_id":"85e87e63-84ef-49e6-ad39-ff023d51eac4","year":2024},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:60f150f3ecb5c058bb07d3af3e6dda0cfd39bc90985e8f701c84b04c83c3e3ef","observation_id":"8a513e8f-4d20-4076-9908-bbbb4e6f7b22","resolution":{"observed_at":"2026-05-16T10:12:43.097914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SmoothQuant: Accurate and effi- cient post-training quantization for large language models","venue":null,"work_id":"ccc99e30-7a63-4611-856f-c932064dbf84","year":2023},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:c649a72654cee02e0d6f350f7068822518c6c19f4ab91360a2f1b98ecf1b8fb6","observation_id":"ec33ad3c-8615-4c6e-b1e7-617c83b6d550","resolution":{"observed_at":"2026-05-16T10:12:43.117587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ABKD: Pursuing a proper allocation of the probability mass in knowledge distillation via α-β-divergence","venue":null,"work_id":"828efb89-84c1-4b65-b947-73386057c890","year":2025},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:f1b0c53510a50567b44e112c08f84bf88e5ef34455352b2ec310558a4050c9fa","observation_id":"2d036904-7760-4448-a948-a4f5a26f7754","resolution":{"observed_at":"2026-05-16T10:12:43.100738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FlashAttention: Fast and memory-efficient exact attention with IO-awareness","venue":null,"work_id":"00f3476a-6eef-4489-8674-a8912e602198","year":2022},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:5830defda992f9824d1f431c4220a43bdb6ea91294f16e927db2e0f46bc22a61","observation_id":"d3811262-8bba-4cbf-95d9-e19345704dd6","resolution":{"observed_at":"2026-05-16T10:12:43.149409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":"2006.04768","doi":"10.48550/arxiv.2006.04768","metadata_source":"pith","pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Linformer: Self-Attention with Linear Complexity","venue":"cs.LG","work_id":"4b717b51-6098-45d0-8e9e-b69bef651bc3","year":2020},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:10b6d126ece2973f34caf1676bae5059b9e3db5fde63bbb5932db27bb64658c8","observation_id":"5713a856-6ac5-48c6-bb7b-ca7d5fe20d09","resolution":{"observed_at":"2026-05-16T10:12:43.053863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficiently mod- eling long sequences with structured state spaces","venue":null,"work_id":"0ad89f6b-d153-4e1f-b45b-f08fb0b01a89","year":2022},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:a1e25e9b4671bd7986e09d271dc409b1a977449aad04a75b8660ea0152260740","observation_id":"9bd3c436-3782-4739-b0ac-2c163593406a","resolution":{"observed_at":"2026-05-16T10:12:43.146849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-07-10T20:07:33.480124Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:b7a68947a67fef941ac5956aef268a5f69fc610d319d37a4c0b5fe51a23e2ecf","observation_id":"2bf076b8-c20c-404f-b0b1-6a02d055ab04","resolution":{"observed_at":"2026-05-16T10:12:43.028490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"06e4672f-ffdd-4ac4-bec3-8f2de824863d","year":2017},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:f2b3091ffc5fcd3670decac0b67b0d306f4896517613c2bd3c3d90158012a2e2","observation_id":"b4e89406-b88d-4609-9a38-250fbb10f18b","resolution":{"observed_at":"2026-05-16T10:12:43.127889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14458","last_updated":"2025-02-23T13:02:09Z","snapshot_observed_at":"2026-07-06T20:39:43.403470Z","submitted_at":"2025-02-20T11:18:39Z","title":"Llamba: Scaling Distilled Recurrent Models for Efficient Language Processing","version":2},"cited_work":{"arxiv_id":"2502.14458","doi":"10.48550/arxiv.2502.14458","metadata_source":"pith","pith_arxiv_id":"2502.14458","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Llamba: Scaling distilled recurrent models for efficient language processing.arXiv preprint arXiv:2502.14458","venue":"cs.LG","work_id":"114086d3-6e40-4b5c-b2a9-6d0819e2bfac","year":2025},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2502.14458","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:3e87533cac1be50d56599cb49925e795ef881eaa7d6989c36e994795609221ce","observation_id":"2fd88c32-d7b5-4ba0-bdaa-eeb02765e86c","resolution":{"observed_at":"2026-05-16T10:12:43.033292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Networks of spiking neurons: the third gen- eration of neural network models","venue":null,"work_id":"9115e013-de05-4032-8ac3-8ea2af2f3448","year":1997},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:22c722b5f39a3c3666974b89f9115b29721528708eeeaf3d53029f8d97e78821","observation_id":"173d2ba8-d934-4f28-9fa5-ac560944e2b2","resolution":{"observed_at":"2026-05-16T10:12:43.133392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning in spiking neural networks","venue":null,"work_id":"632291be-f90e-474a-aa53-2860554dc2ca","year":2019},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:dbfea727ce01d8597c93c16e53039f9696433faf94755799e268549b2bd0ec33","observation_id":"4d9e0c9a-7b5c-423d-bb4d-10b828e92a14","resolution":{"observed_at":"2026-05-16T10:12:43.119999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spikformer: When spiking neural network meets transformer","venue":null,"work_id":"c6b01b18-66ba-4eae-b3b3-fa016cc62901","year":2023},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:676dc98ba677ba45ba137c2174eff06611c1c984be72f722c7efa95f78e317b5","observation_id":"b3882111-a731-4e9d-bf74-074cc7bab6d4","resolution":{"observed_at":"2026-05-16T10:12:43.109128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17268","last_updated":"2024-10-07T12:20:38Z","snapshot_observed_at":"2026-07-06T19:38:00.663759Z","submitted_at":"2024-10-07T12:20:38Z","title":"SPikE-SSM: A Sparse, Precise, and Efficient Spiking State Space Model for Long Sequences Learning","version":1},"cited_work":{"arxiv_id":"2410.17268","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.17268","snapshot_observed_at":"2026-07-03T13:48:21.535269Z","title":"Spike- ssm: A sparse, precise, and efficient spiking state space model for long sequences learning.arXiv preprint arXiv:2410.17268","venue":null,"work_id":"d7b5ef6c-5119-4276-bfbf-ca20c74d2910","year":2024},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2410.17268","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:ac0fd0c12e632cd1648d084087ee8bc3e770b74b3460a491f095b415cbfd0429","observation_id":"f5f3ac7b-cf25-41c8-982b-240c9154246c","resolution":{"observed_at":"2026-05-16T10:12:42.980517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ternary Spike: Learning ternary spikes for spiking neural networks","venue":null,"work_id":"08b0677d-405a-4df6-8bf0-f631ac7050f8","year":2024},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:03767ec539871250ef7976fea9db413cc4f127eeb0f5db44ef161c48d2e71ba9","observation_id":"29fbdd29-ce48-41bc-bc93-69df90352ab9","resolution":{"observed_at":"2026-05-16T10:12:43.135873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10323","last_updated":"2024-06-14T17:44:08Z","snapshot_observed_at":"2026-07-06T18:31:13.039726Z","submitted_at":"2024-06-14T17:44:08Z","title":"GenQA: Generating Millions of Instructions from a Handful of Prompts","version":1},"cited_work":{"arxiv_id":"2406.10323","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10323","snapshot_observed_at":"2026-06-30T22:05:05.834308Z","title":"GenQA: Generating Millions of Instructions from a Handful of Prompts","venue":null,"work_id":"9ce25c9c-5d14-4982-a5d2-a8ce14bfd739","year":2024},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2406.10323","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:721ff247abf76400f1441168dadc12179fb72c942da728d6a70a8b3764531e0b","observation_id":"777ae68e-6444-4b2c-9c84-9c16349c07ef","resolution":{"observed_at":"2026-05-16T10:12:43.041776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openhermes 2.5: An open dataset of synthetic data for generalist llm assistants","venue":null,"work_id":"7fde64ab-badd-4b00-bb1b-efb9594f1c95","year":2023},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:0f7358f189fd3298b49846f51986659ac6dab7dec932efa540b9091ca4172ae0","observation_id":"a92e98eb-af6f-4e2b-939d-f5ad253da31b","resolution":{"observed_at":"2026-05-16T10:12:43.114859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11116","last_updated":"2025-06-09T06:37:15Z","snapshot_observed_at":"2026-07-06T21:41:19.199391Z","submitted_at":"2025-06-09T06:37:15Z","title":"Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models","version":1},"cited_work":{"arxiv_id":"2506.11116","doi":"10.48550/arxiv.2506.11116","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11116","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Infinity Instruct: Scaling instruction selection and synthesis to enhance language models","venue":null,"work_id":"728884e2-e6cf-4dc9-a9ce-0c8146038e70","year":2025},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2506.11116","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:2b6c7204961c3bab4b64b0e7b5ed38dc9f6137a6233d151717f5aa4c1d7fd0a8","observation_id":"9d2dfd73-df24-4083-aa5c-dcc34b52f500","resolution":{"observed_at":"2026-05-16T10:12:43.050066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.11843","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:08:58.122044Z","title":"Spike-temporal latent representation for energy-efficient event-to-video reconstruction","venue":null,"work_id":"fc0f290b-1992-447f-9061-a25afd710e8a","year":2025},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:334e2398a6eb6b965ccdaf5b0f07cf9bfc9fc2a416b607d666e505a0d893c2ff","observation_id":"f5d29993-0b41-4713-8a33-aad6d35b0c29","resolution":{"observed_at":"2026-05-16T10:12:43.024360Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":"2401.02385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-07-09T21:16:34.311040Z","title":"TinyLlama: An Open-Source Small Language Model","venue":"cs.CL","work_id":"d2c14bfc-b868-4f6d-8b13-12bf89321d47","year":2024},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:f52e5a881ef607deab5c72059e1f23f5caa268a58a1425c002dd4764e641ee90","observation_id":"7cb6bdd8-67b5-487f-9972-bac0d3031a37","resolution":{"observed_at":"2026-05-16T10:12:43.004656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SpikeLLM: Scaling up spiking neural network to large language models via saliency-based spiking","venue":null,"work_id":"91b0002b-c69e-4267-b1a7-5f32b242d554","year":2025},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:492cf546c7202b7edb01d095a3b7d6e584ca61527ceb11afd94e7c43d1b11e55","observation_id":"a4f288fb-ca1d-4027-8ff1-7966341ec3f3","resolution":{"observed_at":"2026-05-16T10:12:43.103520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PIQA: Reasoning about physical commonsense in natural lan- guage","venue":null,"work_id":"a5a2ffdc-0d52-4f17-a710-d628f051f3f5","year":2020},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:71e43f169d8583701982ab31f170344ce03264a6ca2f8e221e4b2503aac7764c","observation_id":"4c67de33-1e8c-450f-ad36-54a713f7e982","resolution":{"observed_at":"2026-05-16T10:12:43.106461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"d0f09631-03af-449b-aa52-0106a2e68050","year":2019},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:cff1931f37f3f50005c2a22aa7f577d58e678b5d4de365acb26253293a677b67","observation_id":"da8e25e7-61dc-44d0-84ff-11ac2d484934","resolution":{"observed_at":"2026-05-16T10:12:43.122839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"WinoGrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":"1f061759-99dd-46cf-a8ad-0e6987d059fc","year":2020},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:488ae455fa2158201fc216c46661d8844041c9b7588ea86dae87201fea1bd46e","observation_id":"09b200d6-3d56-4bf4-abe2-2abab7d04292","resolution":{"observed_at":"2026-05-16T10:12:43.141246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HellaSwag: Can a machine really finish your sentence?","venue":null,"work_id":"8d570f10-3af6-46ce-a9fb-bdd21a17e609","year":2019},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:8433dc48c78f8e698aba83990ac3d8233a65852388cff35f21519d53248d8a14","observation_id":"5e229752-007d-4441-92e2-6f18acbfae7e","resolution":{"observed_at":"2026-05-16T10:12:43.125504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:031d19cb756d17fbc9d0139816da3bbe9f7793a4d11135c16544155fb46e3525","observation_id":"4d0f186a-f1fb-42a6-9589-6854d7ca4715","resolution":{"observed_at":"2026-05-16T10:12:43.019876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1.1 computing’s energy problem (and what we can do about it)","venue":null,"work_id":"f8525e6c-bf94-4f32-bfec-567ba1a57904","year":2014},"citing_paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T10:12:35.951089Z"},"links":{"citing_paper":"/paper/2601.21503"},"observation_digest":"sha256:99de6faa6956ba0fc2af84144e03027805731747f7185196d924ee7705491d71","observation_id":"06e91b4b-3930-462f-a944-e0504cc00b60","resolution":{"observed_at":"2026-05-16T10:12:43.112157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.21503","last_updated":"2026-01-29T10:21:28Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T10:21:28Z","title":"MAR: Efficient Large Language Models via Module-aware Architecture Refinement"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":20},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"thesis":"As of 25 July 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2601.21503."}