{"as_of":"2026-08-11T04:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d856060027595d8886d30853b23f6f12c1798696c41c9a0eebec0f37196ccf08","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:53:58.539289Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:39:37.888574Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T11:32:36.738536Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2403.14608"},"observation_digest":"sha256:15b42849c08bd16334167228541a7da0d5671b39ffda495f8ed33b711dae7ee0","observation_id":"7fa2a2e1-44df-41fa-bdc4-6f207275614c","resolution":{"observed_at":"2026-05-13T11:32:36.852883Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-10T22:53:58.539289Z","title":"Pushing mixture of experts to the limit: Ex- tremely parameter efficient moe for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.00530","last_updated":"2025-01-06T23:02:42Z","snapshot_observed_at":"2026-08-10T22:46:20.149918Z","submitted_at":"2024-12-31T16:28:23Z","title":"Superposition in Transformers: A Novel Way of Building Mixture of Experts","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:53:58.539289Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2501.00530"},"observation_digest":"sha256:6b04fdeae5f419095ad00914fb52ee181bcae29cdf2273609ef7419062fcbddc","observation_id":"c8853ec3-6d50-424d-bdb1-dad0cb6c816a","resolution":{"observed_at":"2026-08-10T22:53:58.539289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-10T14:42:10.777637Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15103","last_updated":"2025-06-19T04:00:52Z","snapshot_observed_at":"2026-08-10T23:51:28.758581Z","submitted_at":"2025-01-25T06:56:39Z","title":"Each Rank Could be an Expert: Single-Ranked Mixture of Experts LoRA for Multi-Task Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T14:42:10.777637Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2501.15103"},"observation_digest":"sha256:7e5fce275875dde8876713ca77d915b4c3b4d0e87f22ca660b45ac6cf542eb5c","observation_id":"dbb42976-fe74-4dab-9740-ab63fe3ef16c","resolution":{"observed_at":"2026-08-10T14:42:10.777637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-10T18:56:37.949890Z","title":"Pushingmixtureofexpertstothelimit:Extremely parameter efficient MoE for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16352","last_updated":"2025-01-18T20:17:31Z","snapshot_observed_at":"2026-08-10T23:05:17.957362Z","submitted_at":"2025-01-18T20:17:31Z","title":"Mixture of Experts (MoE): A Big Data Perspective","version":1},"reference_index":201,"source":"pdf_text","source_observed_at":"2026-08-10T18:56:37.949890Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2501.16352"},"observation_digest":"sha256:c7546a32ff2e315fc97b55aa2277a966ee047bfe8295777c94a6697eb0ebb05c","observation_id":"e8cafb0c-e0f6-48f7-b005-1ecf178f0baa","resolution":{"observed_at":"2026-08-10T18:56:37.949890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-08T20:06:23.605001Z","title":"Pushing mixture of experts to the limit: Extremely parameter efficient moe for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05172","last_updated":"2025-02-19T14:36:33Z","snapshot_observed_at":"2026-08-09T03:47:32.466460Z","submitted_at":"2025-02-07T18:55:38Z","title":"Joint MoE Scaling Laws: Mixture of Experts Can Be Memory Efficient","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T20:06:23.605001Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2502.05172"},"observation_digest":"sha256:a373378ea464cb4d33db9283ac2a9d46ee625515c7e810e8127cde47944bbbbd","observation_id":"1d365237-9107-4dd7-b72d-3f21a2b96d82","resolution":{"observed_at":"2026-08-08T20:06:23.605001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-07T11:20:30.470783Z","title":"Pushing mixture of experts to the limit: Extremely parameter efficient moe for instruction tuning.CoRR, abs/2309.05444, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02847","last_updated":"2025-06-03T13:16:00Z","snapshot_observed_at":"2026-08-10T19:33:42.673165Z","submitted_at":"2025-06-03T13:16:00Z","title":"CLONE: Customizing LLMs for Efficient Latency-Aware Inference at the Edge","version":1},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:30.470783Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2506.02847"},"observation_digest":"sha256:bd18742deaacb4bc82dc40d0079e0844dc55cb76edb6a547c167f8cf0b8845d0","observation_id":"ea0fa4ca-9df9-4546-831d-4cdbc6f3621d","resolution":{"observed_at":"2026-08-07T11:20:30.470783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-06T18:57:16.092024Z","title":"Pushing mixture of experts to the limit: Extremely parameter efficient moe for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07024","last_updated":"2025-08-23T00:44:49Z","snapshot_observed_at":"2026-08-11T02:25:05.981020Z","submitted_at":"2025-07-09T16:54:21Z","title":"FlexOlmo: Open Language Models for Flexible Data Use","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:57:16.092024Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2507.07024"},"observation_digest":"sha256:5b3bf0b73d5c983d01c4d102d04291fe0b4b22e73d561fa8ce4e8ed2b94ec7d5","observation_id":"4b8a0bf2-5a07-4d1e-85ee-a0d3dafc1bd1","resolution":{"observed_at":"2026-08-06T18:57:16.092024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-02T19:55:06.859701Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.00573","last_updated":"2026-06-04T02:39:00Z","snapshot_observed_at":"2026-08-04T08:08:12.263429Z","submitted_at":"2026-02-28T09:40:11Z","title":"CoMoL: Efficient Mixture of LoRA Experts via Dynamic Core Space Merging","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T19:55:06.859701Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2603.00573"},"observation_digest":"sha256:8b84e725a50c267d871d6f8cb86e4a69c3d561d74d8a8fc1d99d62d744228310","observation_id":"b4b74f0d-11a8-41c8-b54a-5c498aa59604","resolution":{"observed_at":"2026-08-02T19:55:06.859701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2603.18297","last_updated":"2026-04-03T22:50:01Z","snapshot_observed_at":"2026-07-06T22:49:37.944352Z","submitted_at":"2026-03-18T21:35:53Z","title":"Path-Constrained Mixture-of-Experts","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T09:16:06.226566Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2603.18297"},"observation_digest":"sha256:ebd37f40687169d9cb9b3328636324331093fce335594713639e56dddc41ede4","observation_id":"d0025eb2-978d-447c-967f-6d94267bdc51","resolution":{"observed_at":"2026-05-15T09:19:54.235420Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2604.19835","last_updated":"2026-05-10T18:33:52Z","snapshot_observed_at":"2026-08-08T23:43:56.161397Z","submitted_at":"2026-04-21T05:53:33Z","title":"Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T03:29:16.555166Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2604.19835"},"observation_digest":"sha256:1ee3014a1d006eb3eaf5efd8d7ff8d2a2fbd7fb323e25dcd6b3fb1618eae700a","observation_id":"093744d8-f5cd-4d69-872a-6029c0da1de8","resolution":{"observed_at":"2026-05-10T03:29:21.500546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2604.19835","last_updated":"2026-05-10T18:33:52Z","snapshot_observed_at":"2026-08-08T23:43:56.161397Z","submitted_at":"2026-04-21T05:53:33Z","title":"Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T02:03:02.654035Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2604.19835"},"observation_digest":"sha256:eb41c14cdd829a586e9f6077b474ae13b9bb81abc218169f110ecee7f1caba13","observation_id":"ff7ce1a5-b382-4b94-a756-d3891ef0b49d","resolution":{"observed_at":"2026-05-12T02:06:15.379580Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2604.20721","last_updated":"2026-04-22T16:07:24Z","snapshot_observed_at":"2026-08-11T00:13:14.358093Z","submitted_at":"2026-04-22T16:07:24Z","title":"ALAS: Adaptive Long-Horizon Action Synthesis via Async-pathway Stream Disentanglement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T23:30:14.328540Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2604.20721"},"observation_digest":"sha256:232e56b743a7ccc6f147979b2c3d69333d1d471e0e99a1dedbebd4f4c70b3c04","observation_id":"8f38d63d-897a-4878-9b4b-62fa0b316be7","resolution":{"observed_at":"2026-05-11T14:06:04.922147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2604.26340","last_updated":"2026-04-29T06:45:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T06:45:44Z","title":"Adaptive and Fine-grained Module-wise Expert Pruning for Efficient LoRA-MoE Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T13:22:13.763578Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2604.26340"},"observation_digest":"sha256:41de8400f283e6230c0fbf3568fdb2053a9970b4414790015d20f4115c0984f2","observation_id":"7b232f5a-6bc3-41bd-b406-b1bf64a4e1e2","resolution":{"observed_at":"2026-05-12T09:01:24.481168Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2605.04079","last_updated":"2026-04-14T16:32:50Z","snapshot_observed_at":"2026-07-06T23:16:54.673178Z","submitted_at":"2026-04-14T16:32:50Z","title":"Efficient Handwriting-Based Alzheimer,s Disease Diagnosis Using a Low-Rank Mixture of Experts Deep Learning Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T15:42:17.370111Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2605.04079"},"observation_digest":"sha256:99fd4351207a081b98509e620290d21e11d515b90406888cfd3aabb0e59ec599","observation_id":"e9f318a2-db3c-4565-a91f-d89ddd6cecd1","resolution":{"observed_at":"2026-05-11T10:01:01.233155Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2605.20247","last_updated":"2026-08-06T06:26:16Z","snapshot_observed_at":"2026-08-09T23:09:44.275010Z","submitted_at":"2026-05-18T06:31:14Z","title":"CP-MoE: Consistency-Preserving Mixture-of-Experts for Continual Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T08:37:10.313340Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2605.20247"},"observation_digest":"sha256:39f45d0d8ccb6887834d25c07543beabe3d8cb09c0c1fdc279012b9d9c63235d","observation_id":"0cedc80b-80d5-4038-a091-5c0c2612d871","resolution":{"observed_at":"2026-05-21T08:39:53.484596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2605.26376","last_updated":"2026-05-25T22:53:11Z","snapshot_observed_at":"2026-07-06T23:36:15.452866Z","submitted_at":"2026-05-25T22:53:11Z","title":"BioFact-MoE: Biologically Factorized Mixture of Experts for Vision-Language Prognostic Modeling in Hepatocellular Carcinoma","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T22:20:28.368446Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2605.26376"},"observation_digest":"sha256:ebaac26e423d9456a7b850bf5a7dcd801b64294e9dbd5bb542a8423ca4b1962b","observation_id":"97537789-3f3c-47ec-96ea-a011c8dc5189","resolution":{"observed_at":"2026-06-29T22:24:00.319105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2606.19079","last_updated":"2026-06-17T13:50:51Z","snapshot_observed_at":"2026-08-06T12:44:16.039483Z","submitted_at":"2026-06-17T13:50:51Z","title":"ARIADNE: Agnostic Routing for Inference-time Adapter DyNamic sElection","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T20:53:11.180717Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2606.19079"},"observation_digest":"sha256:b7d67312f507d94a2072bf5b98fc73ace36365621b33e25a6a9693ac15f07c7a","observation_id":"008d0768-53c0-4ed7-9974-646a0eb4114e","resolution":{"observed_at":"2026-07-04T00:49:19.520567Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":"2309.05444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-07-04T06:39:37.888574Z","title":"org/abs/2309.05444","venue":null,"work_id":"245e4eea-5bf0-4a94-90b2-a032ad2cdd76","year":2023},"citing_paper":{"arxiv_id":"2606.21645","last_updated":"2026-06-19T17:56:44Z","snapshot_observed_at":"2026-08-05T10:02:01.473600Z","submitted_at":"2026-06-19T17:56:44Z","title":"Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-06-26T14:18:11.215278Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2606.21645"},"observation_digest":"sha256:35e79e58224c02aba14a2f934fa7ed0ce276044f4a2f436c048530764e46d189","observation_id":"e998ea05-b8cf-4ae6-9613-a89585273f03","resolution":{"observed_at":"2026-07-04T06:39:37.890111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05444","snapshot_observed_at":"2026-08-03T15:00:01.944124Z","title":"arXiv preprint arXiv:2309.05444 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29033","last_updated":"2026-07-31T05:11:25Z","snapshot_observed_at":"2026-08-09T10:38:10.692385Z","submitted_at":"2026-07-31T05:11:25Z","title":"SAM+D: Parameter-Efficient Dimensional Lifting of SAM-Family Models via Depth-Routed LoRA and Depth Shifting","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T15:00:01.944124Z"},"links":{"cited_paper":"/paper/2309.05444","citing_paper":"/paper/2607.29033"},"observation_digest":"sha256:60b41f4a0f518eb7ce3d917112e6104ca7fb327b21a6220ad9aad381ea371360","observation_id":"e32156a8-7ccc-4df2-94e0-a83994b27623","resolution":{"observed_at":"2026-08-03T15:00:01.944124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.05444/citation-record","integrity":"/paper/2309.05444/integrity","json":"/paper/2309.05444/citation-record.json","paper":"/paper/2309.05444"},"outbound":[],"paper":{"arxiv_id":"2309.05444","last_updated":"2023-09-11T13:31:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T18:55:06.895022Z","submitted_at":"2023-09-11T13:31:00Z","title":"Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2309.05444."}