{"as_of":"2026-08-11T18:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d425b710f9a948f10293350885c408dbb9f1ed35a01f961d74a6965967dc5f59","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:00:30.625789Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:30:07.123917Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":"2403.06977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-07-04T19:30:07.123917Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":"bfd0b8be-1b70-4d8f-ac6e-1e111c51038b","year":2024},"citing_paper":{"arxiv_id":"2408.01129","last_updated":"2026-04-06T02:10:55Z","snapshot_observed_at":"2026-08-11T00:37:21.988846Z","submitted_at":"2024-08-02T09:18:41Z","title":"A Survey of Mamba","version":8},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-05-23T22:09:19.917854Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2408.01129"},"observation_digest":"sha256:79acae083510f62b4c9787fda831e2a8435ef9461f925c79680a55d51ae2868d","observation_id":"fc3e6eb1-35bb-48ac-b4bf-c0883b8af3c4","resolution":{"observed_at":"2026-05-23T22:13:30.939914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-11T13:00:30.625789Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13615","last_updated":"2024-12-18T08:53:52Z","snapshot_observed_at":"2026-08-11T12:55:15.141712Z","submitted_at":"2024-12-18T08:53:52Z","title":"MambaLCT: Boosting Tracking via Long-term Context State Space Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:30.625789Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2412.13615"},"observation_digest":"sha256:26d9bb066c11c8a512617e970a5b69ed81da22ab4e6f9791ba81dc5b508adc15","observation_id":"25ac5823-7017-48d0-a5aa-8f0bdc729f79","resolution":{"observed_at":"2026-08-11T13:00:30.625789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-11T11:12:52.333311Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15691","last_updated":"2024-12-20T09:10:17Z","snapshot_observed_at":"2026-08-11T11:08:41.914044Z","submitted_at":"2024-12-20T09:10:17Z","title":"Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T11:12:52.333311Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2412.15691"},"observation_digest":"sha256:1ea3353f163e757137cfbdca0783c9f026a6275f3469a4e737e09fdf60e299b5","observation_id":"7d18cdbb-f0af-447a-9a99-39726de1a73f","resolution":{"observed_at":"2026-08-11T11:12:52.333311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-11T10:29:37.003688Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16602","last_updated":"2024-12-21T12:27:07Z","snapshot_observed_at":"2026-08-11T16:43:25.041150Z","submitted_at":"2024-12-21T12:27:07Z","title":"V\"Mean\"ba: Visual State Space Models only need 1 hidden dimension","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:29:37.003688Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2412.16602"},"observation_digest":"sha256:ee54fcfc0fb5ab054c1d9fc3bc9a9fbf28cbb0958bc1d0883d04268e0c285517","observation_id":"f8ce410b-9b52-42f1-bfad-48c2aae2d9c7","resolution":{"observed_at":"2026-08-11T10:29:37.003688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-10T23:40:07.883499Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20082","last_updated":"2025-04-07T15:51:31Z","snapshot_observed_at":"2026-08-10T23:32:59.646290Z","submitted_at":"2024-12-28T08:42:48Z","title":"MambaVO: Deep Visual Odometry Based on Sequential Matching Refinement and Training Smoothing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T23:40:07.883499Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2412.20082"},"observation_digest":"sha256:68a68e4f2f90eaec3aad9f9ad6fad6d869f041c61ffa870d61a3c949eedc935f","observation_id":"c574a8b3-4361-48b2-8816-b02ceddbf2c2","resolution":{"observed_at":"2026-08-10T23:40:07.883499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-10T21:42:11.569111Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04302","last_updated":"2025-01-08T06:26:16Z","snapshot_observed_at":"2026-08-10T21:34:19.062468Z","submitted_at":"2025-01-08T06:26:16Z","title":"H-MBA: Hierarchical MamBa Adaptation for Multi-Modal Video Understanding in Autonomous Driving","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T21:42:11.569111Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2501.04302"},"observation_digest":"sha256:0226d46914b4dc80f84365c04021d10a619187da740e5bfbdf34e439bc3cc290","observation_id":"9521212c-fc34-4fb2-979e-440ae27c7e8f","resolution":{"observed_at":"2026-08-10T21:42:11.569111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-10T20:38:56.483125Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07810","last_updated":"2025-01-14T03:20:20Z","snapshot_observed_at":"2026-08-10T20:33:00.714408Z","submitted_at":"2025-01-14T03:20:20Z","title":"AVS-Mamba: Exploring Temporal and Multi-modal Mamba for Audio-Visual Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T20:38:56.483125Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2501.07810"},"observation_digest":"sha256:f61027d6e64aea8b6870b87d3a2ad035fee323954ec617909d026b7579cdb8b7","observation_id":"2c0f48e6-09af-4641-b416-3321b1f3bd60","resolution":{"observed_at":"2026-08-10T20:38:56.483125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-10T15:37:30.555080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13829","last_updated":"2025-01-23T16:53:46Z","snapshot_observed_at":"2026-08-11T13:52:50.719719Z","submitted_at":"2025-01-23T16:53:46Z","title":"MV-GMN: State Space Model for Multi-View Action Recognition","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T15:37:30.555080Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2501.13829"},"observation_digest":"sha256:2318f9ba53d99a1e4bd0f1eaee01f2ba2b6458105711a1862c54bb23cf51e20e","observation_id":"de4aa581-649f-4391-b74f-f759561fe1ec","resolution":{"observed_at":"2026-08-10T15:37:30.555080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-07T13:54:45.758010Z","title":"Videomamba: State space model for efficient video understanding.arXiv preprint arXiv:2403.06977, 2024a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20698","last_updated":"2025-05-27T04:07:23Z","snapshot_observed_at":"2026-08-10T15:35:24.157134Z","submitted_at":"2025-05-27T04:07:23Z","title":"Sparsified State-Space Models are Efficient Highway Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:45.758010Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2505.20698"},"observation_digest":"sha256:2457be8391c40123be5e8104a8b506ffed67c8abdd7bbd95a0e5e54013534079","observation_id":"3faf318b-c026-4671-8a37-75a93ea98b8e","resolution":{"observed_at":"2026-08-07T13:54:45.758010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-07T11:55:12.919222Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01206","last_updated":"2025-06-01T22:52:47Z","snapshot_observed_at":"2026-08-10T22:38:12.826399Z","submitted_at":"2025-06-01T22:52:47Z","title":"Mamba Drafters for Speculative Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:12.919222Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.01206"},"observation_digest":"sha256:bef3961027021a663631f68965c42fde3a3120c379dcfed7c00b36949cced3c2","observation_id":"d2465311-0db7-4e7e-8740-81f8cbadd9eb","resolution":{"observed_at":"2026-08-07T11:55:12.919222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-07T04:35:23.682312Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-09T18:47:50.772403Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.682312Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d6b003e05aab206d3170a2eda673b023c947e90ba83e77e125e330c80b75bf12","observation_id":"03a5c6c0-ad48-4a67-be9d-51d07e94ec7f","resolution":{"observed_at":"2026-08-07T04:35:23.682312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-06T22:23:41.396361Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.396361Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:7a45cc08d11bb852f6af9df9f0f86d2b70a5d41cc3995598c45baf2c7c6b6960","observation_id":"60fd24f9-7f8e-4d8d-bade-a4d8a55cc9a8","resolution":{"observed_at":"2026-08-06T22:23:41.396361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-06T17:59:28.795259Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09514","last_updated":"2025-07-13T06:49:32Z","snapshot_observed_at":"2026-08-08T14:01:49.722483Z","submitted_at":"2025-07-13T06:49:32Z","title":"QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:28.795259Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2507.09514"},"observation_digest":"sha256:b576587755e2348c630e055dccf1cab5ca1f8efe90663fbc05065526ea64201d","observation_id":"421ad7d2-17c9-475e-b20f-1894381d7cff","resolution":{"observed_at":"2026-08-06T17:59:28.795259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-06T15:39:16.242741Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15308","last_updated":"2025-07-21T07:08:19Z","snapshot_observed_at":"2026-08-09T04:44:53.499747Z","submitted_at":"2025-07-21T07:08:19Z","title":"Few-Shot Object Detection via Spatial-Channel State Space Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:16.242741Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2507.15308"},"observation_digest":"sha256:cd743bce8c26c8c372063d9afb6a11a5455a52c61052ffa7caf34a67b68af699","observation_id":"ad9977a5-0e2f-4aa0-909f-dee0562fc13e","resolution":{"observed_at":"2026-08-06T15:39:16.242741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-06T14:04:41.966729Z","title":"arXiv:2403.06977","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19778","last_updated":"2025-07-26T04:04:22Z","snapshot_observed_at":"2026-08-10T04:04:57.974693Z","submitted_at":"2025-07-26T04:04:22Z","title":"HydraMamba: Multi-Head State Space Model for Global Point Cloud Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:04:41.966729Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2507.19778"},"observation_digest":"sha256:e0a9051891bbf1dec2101134b729c818a0fb3787c0ca0a49cb91d82407e31392","observation_id":"cf99f8eb-e72c-4ddc-9c7e-33afe00406fe","resolution":{"observed_at":"2026-08-06T14:04:41.966729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-05T21:43:17.884122Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08077","last_updated":"2025-08-11T15:21:59Z","snapshot_observed_at":"2026-08-11T15:52:28.027950Z","submitted_at":"2025-08-11T15:21:59Z","title":"Straightforward Bayesian A/B testing with Dirichlet posteriors","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T21:43:17.884122Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2508.08077"},"observation_digest":"sha256:cfbc08f5bc09fa2f047a884e4f990569e9606c0a9d34f37c8c944f1fd092a715","observation_id":"8897b41a-c3b7-4c25-9cc7-e293b2f6b83a","resolution":{"observed_at":"2026-08-05T21:43:17.884122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-05T21:09:10.359648Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09454","last_updated":"2025-08-13T03:11:28Z","snapshot_observed_at":"2026-08-07T21:53:02.449995Z","submitted_at":"2025-08-13T03:11:28Z","title":"Animate-X++: Universal Character Image Animation with Dynamic Backgrounds","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T21:09:10.359648Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2508.09454"},"observation_digest":"sha256:4023260b40aaf3ea91e5a89ae616da76608c78a4c85194e63842bc9699c99f4d","observation_id":"c77fc7dd-61f4-410d-aa78-68d13ba08b1e","resolution":{"observed_at":"2026-08-05T21:09:10.359648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-05T16:21:44.196052Z","title":"arXiv preprint arXiv:2403.06977 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18681","last_updated":"2025-08-26T05:04:49Z","snapshot_observed_at":"2026-08-10T06:36:28.160367Z","submitted_at":"2025-08-26T05:04:49Z","title":"Hierarchical Spatio-temporal Segmentation Network for Ejection Fraction Estimation in Echocardiography Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:21:44.196052Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2508.18681"},"observation_digest":"sha256:0454454aa75a89f503045bbaf08d18372f004843ae0f9c8adabe1eea01d6ca8d","observation_id":"1a643685-9f82-42b7-a214-1ecb92e22736","resolution":{"observed_at":"2026-08-05T16:21:44.196052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-05T16:13:33.351148Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18834","last_updated":"2025-08-26T09:13:36Z","snapshot_observed_at":"2026-08-10T04:20:59.781960Z","submitted_at":"2025-08-26T09:13:36Z","title":"Boosting Micro-Expression Analysis via Prior-Guided Video-Level Regression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T16:13:33.351148Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2508.18834"},"observation_digest":"sha256:967ae7bdffedfd088d8a7927a66fc66c30d8ce0803b1c9a3d59a836727c1e19c","observation_id":"cbb424ea-83e3-4e0a-95eb-569bb96cbb12","resolution":{"observed_at":"2026-08-05T16:13:33.351148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-05T10:59:05.179915Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03426","last_updated":"2025-09-03T15:56:20Z","snapshot_observed_at":"2026-08-08T23:16:11.446216Z","submitted_at":"2025-09-03T15:56:20Z","title":"Time-Scaling State-Space Models for Dense Video Captioning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:05.179915Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2509.03426"},"observation_digest":"sha256:5c04d51b16345100202fbe274d9ed27ec906b0072d554d43b2aba4e8e2bbfe93","observation_id":"8b02b6aa-54c2-4cd9-9c75-b4f3705b80aa","resolution":{"observed_at":"2026-08-05T10:59:05.179915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":"2403.06977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-07-04T19:30:07.123917Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":"bfd0b8be-1b70-4d8f-ac6e-1e111c51038b","year":2024},"citing_paper":{"arxiv_id":"2606.23126","last_updated":"2026-06-22T10:14:06Z","snapshot_observed_at":"2026-08-08T03:32:50.597514Z","submitted_at":"2026-06-22T10:14:06Z","title":"MambaADv2: Evolving Duality-enhanced State Space Model for Unsupervised Anomaly Detection","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-26T09:26:51.456652Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2606.23126"},"observation_digest":"sha256:099174fe098861c750936c6560accbb3352fca9d373b898ba8aa8340cfab5aab","observation_id":"36de079a-1ff4-4fe6-a456-9424b8091984","resolution":{"observed_at":"2026-07-04T09:49:44.636582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":"2403.06977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-07-04T19:30:07.123917Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":"bfd0b8be-1b70-4d8f-ac6e-1e111c51038b","year":2024},"citing_paper":{"arxiv_id":"2606.25324","last_updated":"2026-06-24T02:41:23Z","snapshot_observed_at":"2026-08-08T01:35:53.818365Z","submitted_at":"2026-06-24T02:41:23Z","title":"Efficient Remote Sensing Instance Segmentation with Linear-Time State Space Distilled Visual Foundation Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-25T21:20:21.295192Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2606.25324"},"observation_digest":"sha256:cfcfd83c408c056b5647803a0a9105d95fe288743896bd131dbec3adc02f9be5","observation_id":"f26f67de-cf65-4323-9ad8-1fd3fdad76a3","resolution":{"observed_at":"2026-07-04T19:30:07.126013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-07-11T09:28:19.511968Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05056","last_updated":"2026-07-06T13:29:28Z","snapshot_observed_at":"2026-08-06T03:32:27.768727Z","submitted_at":"2026-07-06T13:29:28Z","title":"Consistent and Editable: A Balanced Framework for Text-Guided Video Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T09:28:19.511968Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2607.05056"},"observation_digest":"sha256:1393d4bad23abd32f8bedf88eff264e98c89607e78118967b6cca58be0a95632","observation_id":"eec9768f-e5f3-4c09-90a0-481b673ef511","resolution":{"observed_at":"2026-07-11T09:28:19.511968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-02T01:25:52.300928Z","title":"Video- Mamba: State space model for efﬁcient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14711","last_updated":"2026-07-17T20:57:29Z","snapshot_observed_at":"2026-08-08T22:22:41.517289Z","submitted_at":"2026-07-16T08:22:08Z","title":"VideoSEMA: a scalable and efficient Mamba-like attention for video understanding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T01:25:52.300928Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2607.14711"},"observation_digest":"sha256:7fecc977d7e63833f2e0998414765965b5a42e6aba18a7b0114e3d228a6fa042","observation_id":"4869c109-36eb-443f-a9e6-7d320f6d3e54","resolution":{"observed_at":"2026-08-02T01:25:52.300928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.06977/citation-record","integrity":"/paper/2403.06977/integrity","json":"/paper/2403.06977/citation-record.json","paper":"/paper/2403.06977"},"outbound":[],"paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T07:50:40.866688Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2403.06977."}