{"as_of":"2026-08-11T06:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eee1b73adf4199c6fb2a5893df7ed3bed808aaee62a6cab21a5587875e1ec571","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:53:13.683536Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:28:21.968032Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T18:28:23.005011Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"cited_work":{"arxiv_id":"2506.10011","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.10011","snapshot_observed_at":"2026-08-05T18:28:23.005011Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","venue":"cs.MM","work_id":"a5da037d-55a3-4f38-afb8-104b03d7d66a","year":2025},"citing_paper":{"arxiv_id":"2608.03475","last_updated":"2026-08-04T11:14:13Z","snapshot_observed_at":"2026-08-09T07:25:19.067912Z","submitted_at":"2026-08-04T11:14:13Z","title":"Adaptive Modality Reliability Diagnosis and Restoration for Robust Multimodal Intent Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T18:28:21.968032Z"},"links":{"cited_paper":"/paper/2506.10011","citing_paper":"/paper/2608.03475"},"observation_digest":"sha256:5cc9e5b392dab5c18fff2a9dae3a7643135dd3e589d8dbaa2e24042d69320aac","observation_id":"bd6b58bf-1ede-4456-8df5-0a37369eba97","resolution":{"observed_at":"2026-08-05T18:28:23.082431Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10011/citation-record","integrity":"/paper/2506.10011/integrity","json":"/paper/2506.10011/citation-record.json","paper":"/paper/2506.10011"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:18.501416Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations","venue":null,"work_id":"3bc0f71d-8e41-4b49-87c3-e80006a49f0f","year":2020},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.168242Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:d461883efbdaf48a9b82fbd061dc36fb121de347219c0dc9d1e12fff7c630fe5","observation_id":"65151834-6933-450b-ae75-cfc28a95a978","resolution":{"observed_at":"2026-08-07T13:53:18.595478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:17.521093Z","title":"An effective multimodal representation and fusion method for multimodal intent recognition","venue":null,"work_id":"bd4982f8-27dd-41d9-941f-45d0e55dbcda","year":2023},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.626508Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:1312ac5ddf522755b58ddbd87b3a963436fec1bb5fa670a6b89f53e7bd94e33f","observation_id":"c662dd0b-a7f7-4274-88ca-40c71da1938c","resolution":{"observed_at":"2026-08-07T13:53:17.562402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:17.117790Z","title":"Wavelet low-and high- frequency components as features for predicting stock prices with backpropagation neural networks","venue":null,"work_id":"baa2463c-c524-45a6-b4cd-94c960903122","year":2014},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.859368Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:3207871fbec6512715bc71045152dc986f0e981b45fb0404ce94b1ff6feb29e8","observation_id":"844285d0-5182-4bf0-9862-80ef404f5ac4","resolution":{"observed_at":"2026-08-07T13:53:17.188241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:16.680616Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"fb309647-cd6a-4428-a06b-16ec153779cb","year":2021},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.117155Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:fbeb963438c986c969a67e8a3c33331eb33aafa664fb134ebd7a239fe28398f8","observation_id":"5351762b-6e99-416d-a93a-9b5cea62bdce","resolution":{"observed_at":"2026-08-07T13:53:16.757289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:16.528218Z","title":"Enhancing hierarchical text classification through knowl- edge graph integration","venue":null,"work_id":"eaede952-b841-48a4-bdfc-624d2530cd33","year":2023},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.186862Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:deae719190aef2758c9da45396116ff62094c864e855a9b0b093f7e313d7c0da","observation_id":"53cc77e7-a7de-4916-ac32-415e2172f899","resolution":{"observed_at":"2026-08-07T13:53:16.604421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T13:53:12.281877Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.281877Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:01f907a4d4cc31c0b38b2de279fcee5bfa733ad2f98245172b66140963c1d024","observation_id":"76c5fa51-cb9e-457e-bc19-4190429ed67c","resolution":{"observed_at":"2026-08-07T13:53:12.281877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:16.216285Z","title":"Application of deep learning- based user intent recognition in human-computer interac- tion","venue":null,"work_id":"e1cb3d96-3294-4b72-8573-6e652d986982","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.443024Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:2115cd3d33e93d67c3aeb4d7cde9759f0bd4aebbe4fd023222af5c8749e14258","observation_id":"01f7d04b-3699-4b67-a7c5-68123beff21e","resolution":{"observed_at":"2026-08-07T13:53:16.305158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:16.089099Z","title":"Integrating mul- timodal information in large pretrained transformers","venue":null,"work_id":"f93b67e3-dea4-4d8e-8c9d-0dba2ff0c6c0","year":2020},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.535771Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:ea382caead25e0444c8f31074531de96262e657a550b799cdb5fce2b92efbadc","observation_id":"c893c6bc-577a-4710-bb9c-7bca7e4cc74f","resolution":{"observed_at":"2026-08-07T13:53:16.151485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:15.886621Z","title":"Lung dis- ease recognition methods using audio-based analysis with machine learning","venue":null,"work_id":"c64d955e-f1d1-4c0e-a0e9-d4dd4d131010","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.619227Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:b7b31c5596de3664a7de29ef60323a9dcbc811015377c3e0637be63e6fe3c3a0","observation_id":"537cde16-32c4-47fc-9348-a443e9d52949","resolution":{"observed_at":"2026-08-07T13:53:15.982412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:15.749932Z","title":"Towards emotion-aided multi-modal dialogue act classification","venue":null,"work_id":"778e87e7-cd83-4761-9d15-821c6c5ef9c0","year":2020},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.713476Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:f602c7117d1c8dd108ba40448c0b3d87814b1a75382e5830b1a586b9e63aa422","observation_id":"5ebf19b6-41b6-412e-b983-e8ed7e8c3a09","resolution":{"observed_at":"2026-08-07T13:53:15.800603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:15.576268Z","title":"An approach to gps analysis incorporating wavelet decomposition","venue":null,"work_id":"cd940e4d-b098-4b83-be09-e60e1c3b8f21","year":2001},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.781809Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:3f18627ea4d1d35f5aaba200cb15a84b4dab1f17ad8a23a6ec3322a279f821fb","observation_id":"fb36dd2b-c1fc-43b7-8328-41dfc67e9bc1","resolution":{"observed_at":"2026-08-07T13:53:15.656572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:15.118079Z","title":"Contextual augmented global contrast for multimodal intent recognition","venue":null,"work_id":"1d4ddfcd-f17a-45bc-9d88-1497fec30f59","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.907959Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:d0a82176f1ecc4c5a27d37981ef839f52a09d439d3ca35638ed2dbbaaacda22a","observation_id":"90ac473e-94d2-473d-bb1b-bc376f32ce68","resolution":{"observed_at":"2026-08-07T13:53:15.232151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:14.821763Z","title":"Daskt: A dynamic affect simulation method for knowledge tracing","venue":null,"work_id":"362100e6-e0f6-49b8-a3a6-93afd95696b7","year":2025},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.982591Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:8ac01621566dfcd26002278d9ebc8e547ada692dd6d37deee4fc2038d0c2a68c","observation_id":"2336ea3b-e9b4-4a4e-aebb-4cb025858706","resolution":{"observed_at":"2026-08-07T13:53:14.909373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.07250","last_updated":"2017-07-23T05:54:20Z","snapshot_observed_at":"2026-07-06T05:52:17.418793Z","submitted_at":"2017-07-23T05:54:20Z","title":"Tensor Fusion Network for Multimodal Sentiment Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.07250","snapshot_observed_at":"2026-08-07T13:53:13.197355Z","title":"Tensor fusion network for multimodal sentiment analysis","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.197355Z"},"links":{"cited_paper":"/paper/1707.07250","citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:4617201310e24bb22a3cffaefc8e36ae2d5c63eec6851e596215e9ee6f1a6694","observation_id":"d48f3da7-247f-4b13-8254-b45c0acab316","resolution":{"observed_at":"2026-08-07T13:53:13.197355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:14.488098Z","title":"Interac- tive attention transfer network for cross-domain sentiment classification","venue":null,"work_id":"4a6805a2-21eb-4370-8d7d-f53268bb7548","year":2019},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.305502Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:61599172a00d487b885a2d39d76057afb9414c8b8f3ab4424de32c4b1b973763","observation_id":"90aecfec-7ed8-4790-9e8d-d92c6b3f2898","resolution":{"observed_at":"2026-08-07T13:53:14.554346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:14.298937Z","title":"Eatn: An ef- ficient adaptive transfer network for aspect-level sentiment analysis","venue":null,"work_id":"b344f96a-6815-4327-9527-1922866033f2","year":2021},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.364289Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:93853a9c2c83b3122ab5a3a5dbd3b62fb73a336ea270055ab5c5d29b76c02d10","observation_id":"b46351d4-65ba-4489-bf75-ee5132ea2106","resolution":{"observed_at":"2026-08-07T13:53:14.373809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:14.128412Z","title":"Leveraging entity information for cross-modality correlation learning: The entity-guided multimodal summarization","venue":null,"work_id":"63ae4a66-1461-4a7c-91f8-822a7c42ac1a","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.524217Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:aac244a61d52cd25343ff2db186315fb88740c85b9a9fc0f8186e051478d2f82","observation_id":"19e853d8-7498-4ffc-8dee-a01a93f05389","resolution":{"observed_at":"2026-08-07T13:53:14.206497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:14.007134Z","title":"Token- level contrastive learning with modality-aware prompting for multimodal intent recognition","venue":null,"work_id":"b0efdc6a-c2ca-4dd2-9241-149bcd0472fe","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.605318Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:a062cdebc6757b477c0fe085d5ab159af618742aa0b585db79a2497042c105ea","observation_id":"a4e9934e-7480-4035-aefb-1372ea7efd92","resolution":{"observed_at":"2026-08-07T13:53:14.049486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02898","last_updated":"2022-03-06T07:48:24Z","snapshot_observed_at":"2026-07-06T12:44:44.015966Z","submitted_at":"2022-03-06T07:48:24Z","title":"Divide and Conquer: Text Semantic Matching with Disentangled Keywords and Intents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02898","snapshot_observed_at":"2026-08-07T13:53:13.683536Z","title":"Divide and conquer: Text semantic matching with disentangled keywords and intents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.683536Z"},"links":{"cited_paper":"/paper/2203.02898","citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:d128c0ac9fe028c30fffbe01869cf70eaa2c131909b0dad9c19ab74783b5f622","observation_id":"7d09716d-621f-4f55-8a06-f3462bb205ed","resolution":{"observed_at":"2026-08-07T13:53:13.683536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:15.289683Z","title":"Multimodal analysis of im- age search intent: Intent recognition in image search from user behavior and visual content","venue":null,"work_id":"1571b17d-e558-446e-bd9c-49bd4509cfeb","year":2017},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.836220Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:131103d625b76c42479d475fe02e346741a2ea1207e8c2f4bea4aa42d065ce07","observation_id":"a7bd93bb-6c8b-4ea5-9ce0-d558f9e0ca2a","resolution":{"observed_at":"2026-08-07T13:53:15.445914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:17.706961Z","title":"Misa: Modality-invariant and-specific representations for multimodal sentiment analysis","venue":null,"work_id":"f5150633-91e2-4686-bca2-57ec24cd9223","year":2020},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.545547Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:5846d2a6f5b1c1796d97c2f1142fea8b23863fa65abed6a7e6ca4220de042f8c","observation_id":"f65c587a-3fa4-4ffc-935b-92d438c79623","resolution":{"observed_at":"2026-08-07T13:53:17.831841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T13:53:11.950691Z","title":"Pre-training of deep bidirectional transformers for lan- guage understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.950691Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:110c6270fa762873411c9b8361efc0ab686b7616b714f0a20e61a2b8070f3ddb","observation_id":"fe4873a5-2679-44ad-a48c-71d1c643b496","resolution":{"observed_at":"2026-08-07T13:53:11.950691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:16.390983Z","title":"Blind image inpainting via omni-dimensional gated atten- tion and wavelet queries","venue":null,"work_id":"cceeeaa8-56b4-4fbf-a413-8ca2a1caf4de","year":2023},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.361881Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:9a384cd618cf7247e633b9bd1016bae0bfec9dbe68774bc5d209d2e7d41b9f66","observation_id":"63dfa966-0f68-4116-bcbc-5860df35ae89","resolution":{"observed_at":"2026-08-07T13:53:16.455518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:16.842550Z","title":"Learning attention from attention: Efficient self-refinement transformer for face super-resolution","venue":null,"work_id":"0f7e17b0-e705-4d2d-a435-481f15a0fc2d","year":2023},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:12.040419Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:d2585f3ada86ab30c946c4414d57c75cc8f526f863c25e26e52d7d860edd635f","observation_id":"370e159a-6150-4c2f-85d1-4fceae1e186d","resolution":{"observed_at":"2026-08-07T13:53:16.966169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:13.118160Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.118160Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:e6e0c7105f40457c4622cae3e106b7729331468462fbac902681d61323a95307","observation_id":"6c65ad9f-3fc8-4106-b976-3876006bc3a5","resolution":{"observed_at":"2026-08-07T13:53:13.118160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:18.288485Z","title":"Multimodal emotion recognition and intention understanding in human-robot interaction","venue":null,"work_id":"981daaaa-bad3-4e31-aecf-c8b14097659f","year":2021},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.267648Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:68496f3e62833cc23d99f24af8c4be482335af71c29581d7da4d52afe757d5aa","observation_id":"4d98255b-5251-4cce-9ee9-251860045b68","resolution":{"observed_at":"2026-08-07T13:53:18.389839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:18.144560Z","title":"Robust time series denoising with learnable wavelet packet transform","venue":null,"work_id":"e6fd6d69-1099-4a6b-afd5-ada15caacab8","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.349116Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:7d6f35830854c12f8efc405752045555444fa5fff476a52e462d3713d790039e","observation_id":"419ecc1b-571e-46ad-a73a-c1a8d14a07df","resolution":{"observed_at":"2026-08-07T13:53:18.217617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16369","last_updated":"2022-11-23T14:37:11Z","snapshot_observed_at":"2026-08-11T05:35:43.994056Z","submitted_at":"2022-03-30T14:48:46Z","title":"Incorporating Dynamic Semantics into Pre-Trained Language Model for Aspect-based Sentiment Analysis","version":2},"cited_work":{"arxiv_id":"2203.16369","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.16369","snapshot_observed_at":"2026-08-07T13:53:13.811509Z","title":"Incorporating Dynamic Semantics into Pre-Trained Language Model for Aspect-based Sentiment Analysis","venue":"cs.CL","work_id":"18eb667b-8cc8-4a21-a01e-2c5709340a7d","year":2022},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.438911Z"},"links":{"cited_paper":"/paper/2203.16369","citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:63be9bc50fc4b26eeefc79773fb802a34a97c14eaba6b291405e05e50d1494ba","observation_id":"75d32bb8-2474-46c2-a9ee-6ef5f8b52ab3","resolution":{"observed_at":"2026-08-07T13:53:13.880490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:17.330357Z","title":"Sdif-da: A shallow- to-deep interaction framework with data augmentation for multi-modal intent detection","venue":null,"work_id":"607c00a7-cef8-4db6-9169-7ea2dd155799","year":2024},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.758819Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:6f6acf1d528d58452ca0dbd250f9930bc0e36347c09caa9eb460d010826b57fa","observation_id":"30aef6b7-cfc8-4616-947d-773975b77d35","resolution":{"observed_at":"2026-08-07T13:53:17.429563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:17.932635Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks","venue":null,"work_id":"b42f2dd4-0e87-4656-9f5c-d3c6dcc63d81","year":2006},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:11.438869Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:b9c890a64e6322cd630c9da3cb8dd8633afa678fb77345cfb111953858f7b26b","observation_id":"207c9c97-97d3-4186-8a9f-9b2a24f64ccd","resolution":{"observed_at":"2026-08-07T13:53:18.062165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:53:14.671401Z","title":"Multimodal transformer for un- aligned multimodal language sequences","venue":null,"work_id":"8b782cf5-f914-4b68-85d1-b96b4f12e8b5","year":2019},"citing_paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T13:53:13.044915Z"},"links":{"citing_paper":"/paper/2506.10011"},"observation_digest":"sha256:d4cb45c287eeda1ddf450c22ea84870e8ebf334584738b0f7b9baf450d96fac6","observation_id":"00aae3a7-e9ff-414c-9c06-517f70def0b1","resolution":{"observed_at":"2026-08-07T13:53:14.743286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10011","last_updated":"2025-05-27T03:32:45Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-08T15:57:11.685061Z","submitted_at":"2025-05-27T03:32:45Z","title":"WDMIR: Wavelet-Driven Multimodal Intent Recognition"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2506.10011."}