{"as_of":"2026-08-11T21:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:29c22f41cf7fa0dd9ba0ee54bcd2ea8de1cc550b9f1f57419a12eadc9c42bbb2","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:01:51.129920Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.18178/citation-record","integrity":"/paper/2412.18178/integrity","json":"/paper/2412.18178/citation-record.json","paper":"/paper/2412.18178"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.500000Z","title":"Deep learning,","venue":null,"work_id":"991953fa-f0b6-400a-9d8d-09c837fb7f7a","year":2015},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.714900Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:17d8dc4efbab5ecf75210c80bb9cb6703da75b443e5c5df2a9b3d539ee5e596d","observation_id":"9733f64f-5744-44ae-be18-d14126885a46","resolution":{"observed_at":"2026-08-11T05:01:52.506567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.478934Z","title":"Cross-modal causal relational reasoning for event-level visual question answering,","venue":null,"work_id":"bb6c91ce-b486-4496-9903-e41d3067ab4c","year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.725096Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:721b88126bb657bf8964b7a7eadcd5c25f8505081f3c4bff53625e5c63a70bfd","observation_id":"5c684306-c734-4358-9b56-01a8eeb157ea","resolution":{"observed_at":"2026-08-11T05:01:52.485152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:50.735364Z","title":"Visual causal scene refinement for video question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.735364Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:e573042c37267fb7bb25bdcd922bc7d76ec5bab50fd564d19cac25e7a095e659","observation_id":"a2587e0c-d7b8-4790-8072-b9011176c849","resolution":{"observed_at":"2026-08-11T05:01:50.735364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.436913Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":"9fbf26e7-7ac2-4463-b33a-1a82177d007f","year":2017},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.747722Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:4cc3906ca5c63b64e529e325887aba37f726dd6f3e1855e06a85c914d468a7e4","observation_id":"8be91b8d-8bc9-4178-8ee8-7757570903cc","resolution":{"observed_at":"2026-08-11T05:01:52.443684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T05:01:50.758693Z","title":"An image is worth 16x16 words: Transform- ers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.758693Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:2f873ef0235a275aa0f0e1091901427322ae2f202e59adcadd10f86b87a3c8d9","observation_id":"d7dbf352-130a-46fd-afd1-0526b5872f36","resolution":{"observed_at":"2026-08-11T05:01:50.758693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.413431Z","title":"Transformers in vision: A survey,","venue":null,"work_id":"d6ae52f5-090b-46ad-a526-d4a3ea0107bf","year":2022},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.768055Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:96dc144dd072a7b4ad36ce6ea774ab8ff1a459918c6663cf6a2973b93dacf5f4","observation_id":"7b5e4a79-2af3-4789-80ff-cea96b5ad96e","resolution":{"observed_at":"2026-08-11T05:01:52.422552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.392227Z","title":"Attention is all you need,","venue":null,"work_id":"f53e413a-64f4-4ab2-9634-1a351a3d3b26","year":2017},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.777145Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:4c77867d312fd94d0006dd2d142c77abadceeeb7af7b811456ba6985199ac884","observation_id":"0b79c0c8-8748-4457-9c6e-8384cad04039","resolution":{"observed_at":"2026-08-11T05:01:52.399663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10741","last_updated":"2024-11-16T08:47:32Z","snapshot_observed_at":"2026-08-07T20:38:30.370699Z","submitted_at":"2024-11-16T08:47:32Z","title":"MetaLA: Unified Optimal Linear Approximation to Softmax Attention Map","version":1},"cited_work":{"arxiv_id":"2411.10741","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10741","snapshot_observed_at":"2026-08-11T05:01:51.549105Z","title":"MetaLA: Unified Optimal Linear Approximation to Softmax Attention Map","venue":"cs.LG","work_id":"bf052e7b-baa6-4783-a981-1558e6c5aa45","year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.784615Z"},"links":{"cited_paper":"/paper/2411.10741","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:c837842c85b0a2b18d3d25e07489fd2379e28f312b817d2010781b3f54dd33fc","observation_id":"eeeb9e82-af74-43df-a15d-25f3b9ee0a81","resolution":{"observed_at":"2026-08-11T05:01:51.556459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.368711Z","title":"Mamba: A scalable state-space model for sequence modeling,","venue":null,"work_id":"95d6dade-7e87-4a94-a8c7-8533e1205d1d","year":2022},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.793995Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:d4b4590d53616c9ac46dd9b59d5e4cfe5ec8f2a0b76d18ae1ccdde78c01b96dd","observation_id":"07e5d5cf-2eeb-4d46-83d8-2e0ebf8db99f","resolution":{"observed_at":"2026-08-11T05:01:52.375091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-07-06T03:45:28.546418Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-11T05:01:50.805633Z","title":"Learning phrase representations using rnn encoder-decoder for statistical machine translation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.805633Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:90c05373d29671d471b4e86afc0732d5e2e1a5658e727b15f3a3c74c0e4a4f3f","observation_id":"788a99e9-4d2f-4fae-84a7-eec4c54e6f9c","resolution":{"observed_at":"2026-08-11T05:01:50.805633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.345216Z","title":"Were rnns all we needed?,","venue":null,"work_id":"0051bcc7-9afe-4ac5-a0d3-0c874dfbbb96","year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.813220Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:36e1b2359f0a579dacb65ff7fe52c70ec837bb045240aa318001a30901199726","observation_id":"2276e3f5-e7c3-4507-8bbe-3beaa3095555","resolution":{"observed_at":"2026-08-11T05:01:52.353929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-10T22:24:05.831832Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-11T05:01:50.828594Z","title":"Very deep convolutional net- works for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.828594Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:f2cd63ab120de6c81ec1f01d1b3c0a1b144471da1d285759705f48c96d1af469","observation_id":"75b47fcb-e7d5-45a6-aeac-c570085267cf","resolution":{"observed_at":"2026-08-11T05:01:50.828594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.318023Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"cae4194e-1399-49c6-99e2-9ffc38194224","year":2016},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.838650Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:ecee5f7f654f68d0d1b4c05c91bbe0ea6ca5234d6ff77bf2b1a2c97e0cc10cb1","observation_id":"3ac93c7d-4c78-4be1-a1d8-ef75a3202804","resolution":{"observed_at":"2026-08-11T05:01:52.327470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.292217Z","title":"Densely connected convolutional networks,","venue":null,"work_id":"7c006e0a-17e1-4940-8d4c-7b68e6c8b927","year":2017},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.848614Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:0004256e0b16f1234bc8bb7506bc840e042a9da55cf5f6325368c57706ec1b28","observation_id":"495f7b9f-9f39-4406-9af3-5fc98b78271e","resolution":{"observed_at":"2026-08-11T05:01:52.300103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.248486Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"c6552b1b-dc10-48e5-8ef5-89a16d920318","year":2021},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.856502Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:c7288cbb46ed14ca757e83f8ab2520f181ec4c3ae271633ccd3512686fe093be","observation_id":"30b470bd-3b5f-43cd-932e-0f2734815d4d","resolution":{"observed_at":"2026-08-11T05:01:52.260300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.214173Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":"c5df5f41-1285-4fff-bab7-448e6e9786f5","year":2021},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.864719Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:4822d9a9af5abcc6ee7cb84a011625216334d445817fef08ebc7ad7a98c01c50","observation_id":"0ab436b2-b8cb-438d-9193-ea4c6c8d747e","resolution":{"observed_at":"2026-08-11T05:01:52.221188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.177456Z","title":"Trans4mer: State-space models for vision,","venue":null,"work_id":"b749c58f-5168-4546-b214-6e35a62de8e3","year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.871657Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:b3d96815b8075dc924059860943fcd89360e26f1d8b7096f69063b9052c594b7","observation_id":"dde98408-d494-4c6a-8b2b-3f1085eb1cf9","resolution":{"observed_at":"2026-08-11T05:01:52.187324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04722","last_updated":"2024-01-09T18:53:20Z","snapshot_observed_at":"2026-07-06T17:13:25.341853Z","submitted_at":"2024-01-09T18:53:20Z","title":"U-Mamba: Enhancing Long-range Dependency for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04722","snapshot_observed_at":"2026-08-11T05:01:50.882765Z","title":"U-mamba: Enhancing long- range dependency for biomedical image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.882765Z"},"links":{"cited_paper":"/paper/2401.04722","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:dea8fa1afe00b2037628e76bed95fee5b6045d290fda6155397797d4cc717662","observation_id":"38cb0dd1-e9bb-420e-8f04-903fa2c48617","resolution":{"observed_at":"2026-08-11T05:01:50.882765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.148122Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model,","venue":null,"work_id":"39de7cc5-64ed-4775-b15c-1da0923bf5e3","year":null},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.889846Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:ddebb4f6b7ab2343463c89266ab7786eea10885aab9c3e0c17610c82c3c4f6cd","observation_id":"1e21440d-301c-4aeb-a894-b0ad396eb474","resolution":{"observed_at":"2026-08-11T05:01:52.156468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.01234","last_updated":"2023-01-01T23:42:32Z","snapshot_observed_at":"2026-08-05T15:59:57.906944Z","submitted_at":"2023-01-01T23:42:32Z","title":"AmbieGen: A Search-based Framework for Autonomous Systems Testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.01234","snapshot_observed_at":"2026-08-11T05:01:50.902137Z","title":"Vision mamba: A scalable state-space model for vision tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.902137Z"},"links":{"cited_paper":"/paper/2301.01234","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:d2f59dd7d9091cf9dde25a00705f00f654c418ba9012738d659fc3b63bb06415","observation_id":"4eef11fb-9f1b-4a10-bdf2-afc5a6450253","resolution":{"observed_at":"2026-08-11T05:01:50.902137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.115185Z","title":"Finding structure in time,","venue":null,"work_id":"8103eb13-ece2-441d-a291-b8ac6972fd57","year":1990},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.911552Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:5fc99f711e89d963cb21ded85216e7d67e12e30ce1d29447286497c76630f8a4","observation_id":"947ffc0a-735c-418f-85aa-698f72213363","resolution":{"observed_at":"2026-08-11T05:01:52.121734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.078016Z","title":"Learning long-term dependencies with gradient descent is difficult,","venue":null,"work_id":"2479da1e-df0b-4c65-9729-3c2ba2f1dae4","year":1994},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.919807Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:1448a493abe62e5ce5879d1436e0bf312f11a868b6f5fb9646ce58c6004821f2","observation_id":"873293aa-31e3-4ea5-9fc4-be70ad4ceea5","resolution":{"observed_at":"2026-08-11T05:01:52.093615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:50.940207Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.940207Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:7a198e86381926f25990f6f5b1e1b206ff934ce583153e5907280e3fdde3f3ba","observation_id":"fd802d41-30d3-45d8-8c0b-f03a8761b1f9","resolution":{"observed_at":"2026-08-11T05:01:50.940207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09029","last_updated":"2023-12-09T10:06:08Z","snapshot_observed_at":"2026-08-03T06:56:29.064116Z","submitted_at":"2023-05-15T21:31:10Z","title":"Log-concavity and log-convexity of series containing multiple Pochhammer symbols","version":3},"cited_work":{"arxiv_id":"2305.09029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.09029","snapshot_observed_at":"2026-08-11T05:01:51.393631Z","title":"Log-concavity and log-convexity of series containing multiple Pochhammer symbols","venue":"math.CA","work_id":"7c08f9cf-229f-47cc-b892-77d72f9c9f97","year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.951035Z"},"links":{"cited_paper":"/paper/2305.09029","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:2983caeb022c05d82606968bc0495a7f3c03d1d76809ea30d3ec5c7e76a325c2","observation_id":"b524a44d-b908-4629-9803-aab37ea7e7f2","resolution":{"observed_at":"2026-08-11T05:01:51.401059Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:52.022339Z","title":"Complex diagonal recurrence and exponential gating for rnns,","venue":null,"work_id":"78fbbb54-75f8-4f48-bfe6-b87cf3eda81a","year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.957029Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:956b937b1f197712f727eed39dba31367b677a4772e67e0382d8c7c2b9bba7a5","observation_id":"2e4108e2-5fd7-4db0-b9c6-2268b9d6d8fc","resolution":{"observed_at":"2026-08-11T05:01:52.030486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.980743Z","title":"Minrnns: Simplified recurrent models for efficient sequence modeling,","venue":null,"work_id":"5d2334db-f87b-4f47-be8f-73c8e92f20e3","year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.963061Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:debe25c4cc8bfa593e340479c934706d2ef603ecb85acdee92ba2eb5a7db8126","observation_id":"13d78d51-2073-4f56-8427-3a2aeb896d55","resolution":{"observed_at":"2026-08-11T05:01:51.991384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.950551Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":"673fee6f-1ee0-4ddb-9b4e-33a11322d440","year":2009},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.970845Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:549f858f11e3814fdb47adc4e7af8c0ccc1e216115707175536d5cdad593d9c2","observation_id":"3e349440-627c-48e8-aede-5ca06111b79c","resolution":{"observed_at":"2026-08-11T05:01:51.963635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.12877","last_updated":"2021-01-15T15:52:50Z","snapshot_observed_at":"2026-08-09T03:59:14.830524Z","submitted_at":"2020-12-23T18:42:10Z","title":"Training data-efficient image transformers & distillation through attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.12877","snapshot_observed_at":"2026-08-11T05:01:50.977814Z","title":"Training data-efficient image transformers & distillation through attention,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.977814Z"},"links":{"cited_paper":"/paper/2012.12877","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:4dacc468f0d93c8fab278d3b8bdfc833b3b8efc357fcfe4ebed4c086ece79bd9","observation_id":"6c646715-58ca-495e-966e-624831cc9755","resolution":{"observed_at":"2026-08-11T05:01:50.977814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T05:01:50.984867Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.984867Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:123d25f3af1b11e62af278a297170ae199647ff525525300093a1d8e2f48f616","observation_id":"0cefa0bc-4ad4-42fa-ac5b-a34be5ac0e72","resolution":{"observed_at":"2026-08-11T05:01:50.984867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.912646Z","title":"Acceleration of stochastic approximation by averaging,","venue":null,"work_id":"b9f4396b-2001-4086-8c38-41e5fb195748","year":1992},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:50.991517Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:5b4a1aea9dae687945267a5fe161436347447ad9bb0e26885c4d81f7de992895","observation_id":"18b73420-54b1-4875-b2f3-f21e56e3d160","resolution":{"observed_at":"2026-08-11T05:01:51.923109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.872299Z","title":"Aggregated residual transformations for deep neural networks,","venue":null,"work_id":"cbba43c8-a936-4b05-b98c-316239d90e3d","year":2017},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.000037Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:7b32cfe090e66fef68b2dc296bae3ac0174a06ad17f8ce92a9adf21a98a9eae0","observation_id":"1b80910a-3952-46de-ade5-c8e6dbc1a7fb","resolution":{"observed_at":"2026-08-11T05:01:51.884750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.843046Z","title":"Designing network design spaces,","venue":null,"work_id":"526eaabd-12dc-4c94-aa06-6177bae2cf28","year":2020},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.010132Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:e8a13b31e2557e2748a6c9ab9c9cd4394c6ad134b87cab72184db6f52790fd4f","observation_id":"fd8693fd-c58a-4d73-842f-f9c7546f17b6","resolution":{"observed_at":"2026-08-11T05:01:51.856503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.808632Z","title":"Upernet: Unified perceptual parsing for scene understanding,","venue":null,"work_id":"34ed1115-8ce1-4d99-92b5-86662743872c","year":2020},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.018619Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:2cc68f313beee2c6a3242ae0811cf7d1e406ef4d82f314f907546a23ee84a416","observation_id":"b92df596-aa1e-4ebf-8c19-9578456936cf","resolution":{"observed_at":"2026-08-11T05:01:51.817371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.775302Z","title":"Semantics-aware adaptive knowledge distillation for sensor-to-vision action recognition,","venue":null,"work_id":"6c61f1de-aeb1-4f0b-abca-9059bd62c900","year":2021},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.027372Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:3f092e1b86966c71728e6b51d20c5da29551de036dc797abb6224270dfecf0b9","observation_id":"b52d23e7-1963-42e4-b081-5803ff554a7f","resolution":{"observed_at":"2026-08-11T05:01:51.785613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.035212Z","title":"Tcgl: Temporal contrastive graph for self-supervised video representation learning,","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.035212Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:e6d840ad5f48bbfbf7b4aae03fa3c518da66c00e9f26d0ae6c91247a064b273b","observation_id":"8aeb352c-6164-4dad-b2c9-32abb4bb9050","resolution":{"observed_at":"2026-08-11T05:01:51.035212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.731157Z","title":"Enhanced soft label for semi-supervised semantic segmentation,","venue":null,"work_id":"fa5d51cd-a2f2-4793-a36f-d8aa2b0bbe4d","year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.044512Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:f3fc64ec79a9e90f1aa0914943f02b79122ae34c747acdbdd172982d7fc1e686","observation_id":"aa344d18-f5e1-42cf-a086-63614c582120","resolution":{"observed_at":"2026-08-11T05:01:51.743746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.698206Z","title":"Causal reasoning meets visual representation learning: A prospective study,","venue":null,"work_id":"2f34a9f3-a7a8-4924-aee3-2804963e8afd","year":2022},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.055366Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:5a942be9605080b536ff527065c91a9da9efcf1fc7167c28fea8be0710e72240","observation_id":"0f70af99-89a1-4ac6-a606-46baf55d4e9b","resolution":{"observed_at":"2026-08-11T05:01:51.706889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.064512Z","title":"Skeletonmae: graph-based masked autoencoder for skeleton sequence pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.064512Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:c02b8dc3d7a95e786089af45ae55db835e5c19e0ebeca8e415d3b09a776b9cda","observation_id":"abd95ae7-18a7-4752-a50e-7cc2b2316d5a","resolution":{"observed_at":"2026-08-11T05:01:51.064512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.081062Z","title":"Hybrid-order representation learning for electricity theft detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.081062Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:7bd4e8977d2cecf9dbdee1eca1938f6ce8483949441be086ef419c5ef2991bb8","observation_id":"fda35e08-fd05-4dc1-b6c5-cda643f0afa0","resolution":{"observed_at":"2026-08-11T05:01:51.081062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09117","last_updated":"2025-05-29T08:27:32Z","snapshot_observed_at":"2026-08-07T10:24:44.876360Z","submitted_at":"2023-03-16T07:23:55Z","title":"Cross-Modal Causal Intervention for Medical Report Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09117","snapshot_observed_at":"2026-08-11T05:01:51.089377Z","title":"Cross-modal causal intervention for medical report generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.089377Z"},"links":{"cited_paper":"/paper/2303.09117","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:6d7fb6624d409707a79f174e6686a7dcca245ee1d38a29a519ed70dea2dc9f22","observation_id":"6a6a0050-3fdf-4fe2-bfae-367725de82c9","resolution":{"observed_at":"2026-08-11T05:01:51.089377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06886","last_updated":"2025-08-25T02:20:09Z","snapshot_observed_at":"2026-08-06T16:04:56.349386Z","submitted_at":"2024-07-09T14:14:47Z","title":"Aligning Cyber Space with Physical World: A Comprehensive Survey on Embodied AI","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06886","snapshot_observed_at":"2026-08-11T05:01:51.106468Z","title":"Aligning cyber space with physical world: A comprehensive survey on embodied ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.106468Z"},"links":{"cited_paper":"/paper/2407.06886","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:761a3b79ed7bdac4bfc5f4d9ddbc6706d7b2cada767f8ab3f55f2139d39dc16f","observation_id":"56bfea99-499b-43b3-93d0-4bac88f49791","resolution":{"observed_at":"2026-08-11T05:01:51.106468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09082","last_updated":"2025-03-19T13:31:16Z","snapshot_observed_at":"2026-08-11T17:18:34.737386Z","submitted_at":"2024-12-12T09:08:13Z","title":"Towards Long-Horizon Vision-Language Navigation: Platform, Benchmark and Method","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09082","snapshot_observed_at":"2026-08-11T05:01:51.113626Z","title":"Towards long-horizon vision-language navigation: Platform, benchmark and method,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.113626Z"},"links":{"cited_paper":"/paper/2412.09082","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:929b64768c17ec690e6de9a4514f4a9a53d59d09c4439c8ab1f9958533cf9a76","observation_id":"61cd60ed-b02e-434d-bfaa-b35568a0a1fc","resolution":{"observed_at":"2026-08-11T05:01:51.113626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15734","last_updated":"2024-12-24T01:53:17Z","snapshot_observed_at":"2026-08-05T20:39:49.424921Z","submitted_at":"2024-04-24T08:46:25Z","title":"ODMixer: Fine-grained Spatial-temporal MLP for Metro Origin-Destination Prediction","version":4},"cited_work":{"arxiv_id":"2404.15734","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.15734","snapshot_observed_at":"2026-08-11T05:01:51.204753Z","title":"ODMixer: Fine-grained Spatial-temporal MLP for Metro Origin-Destination Prediction","venue":"cs.CV","work_id":"c5e042ce-af8b-487b-92f1-446a962c120a","year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.122187Z"},"links":{"cited_paper":"/paper/2404.15734","citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:1c5135df1253b0a367f7b1ff629dd1a6d5f4d7894152206dfdcd21d8abb66afa","observation_id":"3a182843-6dd1-40b9-b35b-b35a5e1a7391","resolution":{"observed_at":"2026-08-11T05:01:51.222208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:01:51.618893Z","title":"Diversity matters: User-centric multi-interest learning for conversational movie recommendation,","venue":null,"work_id":"f4155b84-e2c2-4c6a-9fa5-f0271f902fed","year":2024},"citing_paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:01:51.129920Z"},"links":{"citing_paper":"/paper/2412.18178"},"observation_digest":"sha256:6641341505190c8901c279090b3b7847beedc6758ffaac1369c908dca30d8b9d","observation_id":"1c4862db-4f17-470d-96a9-c40681087b38","resolution":{"observed_at":"2026-08-11T05:01:51.628481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.18178","last_updated":"2024-12-25T06:33:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T04:55:28.985175Z","submitted_at":"2024-12-24T05:27:11Z","title":"VisionGRU: A Linear-Complexity RNN Model for Efficient Image Analysis"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.18178."}