{"as_of":"2026-08-11T18:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb08ef0c27052eb7c7ed5b1ee63e66f1aac4e5514d6a8b19a3b84b1efda4e474","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:13:12.444746Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.02512/citation-record","integrity":"/paper/2501.02512/integrity","json":"/paper/2501.02512/citation-record.json","paper":"/paper/2501.02512"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.910834Z","title":"Major depressive disorder,","venue":null,"work_id":"3bb9d396-e7ee-4403-be6a-973bc1b3e2d4","year":2016},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.770786Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:e9070812cf6c09be54ed1a524e11a3121d7df543e6843f81b125fea182b0ed36","observation_id":"fa1ee605-4d01-4c8b-9f59-7b9cd1c253a9","resolution":{"observed_at":"2026-08-10T22:13:14.927553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.882111Z","title":"Insights into detecting adult ADHD symptoms through advanced dual-stream machine learning,","venue":null,"work_id":"9f41d5ff-fdf2-480f-93ea-757e719164a4","year":2024},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.786959Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:7e61a28d324f4f72cc740e27b2b452173b365fb0e167e3a16cf41d9c42943a1c","observation_id":"ab5e073a-eb8b-44c5-b122-5c36ab601bdb","resolution":{"observed_at":"2026-08-10T22:13:14.889296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.792876Z","title":"Machine learning in ADHD and depression mental health diagnosis: A survey,","venue":null,"work_id":"a768157d-dfec-4ec1-8b7d-1e0dfe5fbead","year":2023},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.800838Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:3171c89ef79b14491f26c777819627394f96780d7eef8b73dd7321e3e703ca93","observation_id":"2c3fa338-f23a-4e07-9097-43483d498bdd","resolution":{"observed_at":"2026-08-10T22:13:14.827854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.704851Z","title":"Harnessing video intelligence: Intelligent system for adhd detection,","venue":null,"work_id":"7f82ae18-a986-4ba4-807a-9c238dd68a4a","year":2024},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.834888Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:a82aa855f2f5cc710fc6b39ebc5d5340dbd552b063fb9b74973b800b42066cdd","observation_id":"5e1d42a5-0928-4682-8028-c61bab82b0aa","resolution":{"observed_at":"2026-08-10T22:13:14.754753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.569266Z","title":"Acoustic and text features analysis for adult ADHD screening: A data-driven approach utilizing diva interview,","venue":null,"work_id":"3b88963e-083e-4c07-b886-e384c949d17a","year":2024},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.857314Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:d1d7008cd25c41cb860616f560b5f81617c245b4e0eb190798c6c0f411b55542","observation_id":"ba7913db-3756-45a4-b08d-5a6e2b65682f","resolution":{"observed_at":"2026-08-10T22:13:14.601914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.440665Z","title":"Deep learning for depression recognition with audiovisual cues: A review,","venue":null,"work_id":"928c5676-5ecb-4203-8705-4f05785ce3af","year":2022},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.889028Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:271591fabdfdbba14b41c32581d9e293420711aca30cec7a4d24b81ce2e122e8","observation_id":"a88f54c3-9d97-4c03-82d3-46423b8aaf02","resolution":{"observed_at":"2026-08-10T22:13:14.474801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.367204Z","title":"Acoustical properties of speech as indicators of depression and suicidal risk,","venue":null,"work_id":"5b823d66-34d9-41bc-9083-fedb25c4078f","year":2000},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.921957Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:6594dbbe0a0f50bf638c4e4f471f82f77cec42c5beb9e3c65c59faa943d7bccd","observation_id":"44b5a1ea-65cf-4f97-9f1c-3af2709492a7","resolution":{"observed_at":"2026-08-10T22:13:14.394836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.260517Z","title":"Automatic depression level detection via lp-norm pooling,","venue":null,"work_id":"70490516-54a1-4388-a317-45b6c6285ce4","year":2019},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.954752Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:19b35e9030c84b9e8a64de046a339e8030bf4bbfd8f0e4f2cbf0bdd45f1f4ce4","observation_id":"c12f032a-a192-454d-b5a4-9eaaec0e7deb","resolution":{"observed_at":"2026-08-10T22:13:14.275790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.215588Z","title":"A hierarchical depression detection model based on vocal and emotional cues,","venue":null,"work_id":"3641eae0-67d0-4869-a422-af05bf8a22c6","year":2021},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:11.991079Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:d543d15fe9ab4c2481fac8284ec8c9698a178dae02e0470da6a100983b2d6a90","observation_id":"d7e57681-a91c-434d-a5db-2efeabee8b0c","resolution":{"observed_at":"2026-08-10T22:13:14.225206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.184704Z","title":"Position and orientation-aware one-shot learning for medical action recognition from signal data,","venue":null,"work_id":"eb3590ee-c1f4-487d-9100-046db6fa3c2c","year":2024},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.014992Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:1bb349d79bcbed0c9f51b82631102c67a861275af68baaea484ab15f722faf84","observation_id":"91008465-726b-4bcb-8a55-f4c397757e16","resolution":{"observed_at":"2026-08-10T22:13:14.190526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:14.074771Z","title":"Speechformer++: A hierarchical efficient framework for paralinguistic speech processing,","venue":null,"work_id":"0cbdc523-ec1f-4175-a1da-e3b634d94f03","year":2023},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.041590Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:2b02cfde8ab982f81be5a13f0a59e9109b24a835da8ba59930a7c0419c786f44","observation_id":"9f1e6346-3dec-45d8-bad5-6b20ecee721d","resolution":{"observed_at":"2026-08-10T22:13:14.113548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.922125Z","title":"Wavdepressionnet: Automatic depression level prediction via raw speech signals,","venue":null,"work_id":"cc0e7b56-bec9-43f8-aa33-74063662d5ad","year":2023},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.051516Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:b5695bec9109d9898474ed346e577c60a6a3ad00e9aa3f261fdbd7d106bc0d2f","observation_id":"fe689840-a74b-4976-b7a2-63ecc7e01bdb","resolution":{"observed_at":"2026-08-10T22:13:13.964753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:12.078454Z","title":"Rabiner and B.-H","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.078454Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:5da2d167fdcdf37489d743ece0acd1b337d48d155248dfd6ba2e51d977d77d9c","observation_id":"e1224455-565b-4dc2-9d1e-5f2bca12e9af","resolution":{"observed_at":"2026-08-10T22:13:12.078454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.672934Z","title":"Tdca-net: Time-domain channel attention network for depression detection.,","venue":null,"work_id":"dede75d4-9eb3-4cc7-a565-2e637c6dcde1","year":2021},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.113017Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:b7c90d3420f5380ac4494caa04f0a02050d262e37e892ee8aa9a2b5fdfd5f3e0","observation_id":"db113268-63a5-4bb1-b40c-4f809a373c84","resolution":{"observed_at":"2026-08-10T22:13:13.714881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.613136Z","title":"Csenet: Complex squeeze-and- excitation network for speech depression level prediction,","venue":null,"work_id":"5da80c48-2d20-4409-90b1-4856ff1c5697","year":2022},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.124760Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:e82476bc20876533a3ddda84be9ba9dcef28258fa82c2599d469d22242a6cbe4","observation_id":"961f98a8-b405-4509-b3d1-14b31146f2c9","resolution":{"observed_at":"2026-08-10T22:13:13.640857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.544750Z","title":"Dual-path rnn: efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"42e42271-214c-4efc-8b04-32d1861b8f54","year":2020},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.154751Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:dc3b78ec392e629007aba793a964651bb9d3aa386d6f52e5dd3e08ea6dfc3644","observation_id":"459dd75c-4e81-4468-9073-8fb67c449782","resolution":{"observed_at":"2026-08-10T22:13:13.585965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.410035Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"c509c394-1f5d-437e-99be-f2beb1897731","year":2021},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.182525Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:92190120511a0722ee5431ea8862c00c5009a40a373fd3851d21b0908f97afc5","observation_id":"eec4d20e-b4ec-4db7-8f6c-aa1baeb4dd03","resolution":{"observed_at":"2026-08-10T22:13:13.438406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.379152Z","title":"Dual-path transformer network: Direct context-aware modeling for end-to-end monaural speech separation,","venue":null,"work_id":"485d108b-40e3-445a-9203-7fb490a12d9e","year":2020},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.195477Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:ab5e83a0e30b43b78f60a847e331490e53db8c9ef130f6bf5703edff3def90db","observation_id":"fbc9b147-e458-42f8-818f-28b5d3248a7f","resolution":{"observed_at":"2026-08-10T22:13:13.390273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.266536Z","title":"Combining recurrent, convolutional, and continuous-time models with linear state space layers,","venue":null,"work_id":"aefa6cb1-de35-4ec4-9a43-696ea4427984","year":2021},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.201686Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:3331b2f844e8906592b793bfd9fa911e66478b143cce4721ba103a2c0858999a","observation_id":"d337cd39-446b-4c02-9533-5072f3e6d373","resolution":{"observed_at":"2026-08-10T22:13:13.315340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.202388Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":"b2a61c51-c815-4288-96a4-ff8e0f4a7ec6","year":2022},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.207128Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:0b699e3ce0dc4fcaf087c46ebd9547cfe85c6072b650118cfc29c08d6788d53e","observation_id":"00546175-ed13-4830-95f3-d40b76a550a6","resolution":{"observed_at":"2026-08-10T22:13:13.217506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-10T22:13:12.227474Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.227474Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:abbc0a341a5f87dfdb39cd274f52fec2292cab5aeaa799297708ab079af1d5fa","observation_id":"c92a989c-498f-4f47-9fe7-764bad697b4a","resolution":{"observed_at":"2026-08-10T22:13:12.227474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12609","last_updated":"2025-04-27T05:17:15Z","snapshot_observed_at":"2026-07-06T18:17:12.404441Z","submitted_at":"2024-05-21T09:04:48Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12609","snapshot_observed_at":"2026-08-10T22:13:12.242360Z","title":"Mamba in speech: Towards an alternative to self-attention,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.242360Z"},"links":{"cited_paper":"/paper/2405.12609","citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:f227f90d1c49619e80b8e84f00153693c1ada472147b5e1990b1aa78e0d3bf51","observation_id":"04c5f22a-0149-41f9-a863-c11e45e03a90","resolution":{"observed_at":"2026-08-10T22:13:12.242360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.122135Z","title":"Beyond self-attention: External attention using two linear layers for visual tasks,","venue":null,"work_id":"8380db39-beaa-46e9-b95a-154188b86d60","year":2022},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.261277Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:e83aa136d4090e51899eda45f6c217c73f4455653c055b27c5a5b51772025de1","observation_id":"bff6a092-76f0-49e0-be87-ddbdaca021d5","resolution":{"observed_at":"2026-08-10T22:13:13.147174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:13.063817Z","title":"A VEC 2013: The Continu- ous Audio/Visual Emotion and Depression Recognition Challenge,","venue":null,"work_id":"c9efd70b-83e9-4224-99f4-096772701e34","year":2013},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.285587Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:85dc2b2b6450be8c76798f13128b038a2e552d0a14491fec78c081fffed067a1","observation_id":"feed49f8-b1ae-4422-8dcb-3db9f079e738","resolution":{"observed_at":"2026-08-10T22:13:13.095540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:12.965657Z","title":"A VEC 2014: 3D Dimensional Affect and De- pression Recognition Challenge,","venue":null,"work_id":"43c921c5-c041-4544-b99f-96c1f2e11c68","year":2014},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.315800Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:5e4c3ed1e264194b83856fdb1004427fafd6df45cc0d3ac4f80198e0cf7a7472","observation_id":"23c95c8e-b75d-491a-aeed-f007b82fdc96","resolution":{"observed_at":"2026-08-10T22:13:12.991563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:12.824185Z","title":"A narrative review of the beck depres- sion inventory (bdi) and implications for its use in an alcohol-dependent population,","venue":null,"work_id":"81b9a65c-19ac-40ab-afc9-579c5635705f","year":2010},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.346337Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:e6b30f26ba69a797b9e8d7085012b1afd7e8b7d2b360ffab443727dfe937b2a8","observation_id":"e3caaec0-7dc3-45eb-9e65-5646cf1a1d96","resolution":{"observed_at":"2026-08-10T22:13:12.863380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:12.690877Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"57379598-38b9-4ddc-9b1b-64ba9b6d6256","year":2015},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.386166Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:b19daee97a208953a2ae69793cb9d5bf46f86c21f04e2f12ce3d63159d9cb342","observation_id":"6beb8513-8385-474f-907a-f7e829fdd25e","resolution":{"observed_at":"2026-08-10T22:13:12.726550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:12.421916Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.421916Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:06e0c0eb2e5ba82eb056f60092fa530ce579e00162817be4cd2d34a6350b1b52","observation_id":"16897816-ba9d-441c-9044-46a27a17124c","resolution":{"observed_at":"2026-08-10T22:13:12.421916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:13:12.548364Z","title":"Multimodal spatiotem- poral representation for automatic depression level detection,","venue":null,"work_id":"00f7d07f-b33f-40af-9433-c9c346d45aa0","year":2020},"citing_paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:13:12.444746Z"},"links":{"citing_paper":"/paper/2501.02512"},"observation_digest":"sha256:ad60e7a3f73826ec6ab69d6fbd186368abb7f8ab18207f719a7db24f3ffef0dd","observation_id":"8af57a7d-18f2-4ca1-bca6-f23c7162cb62","resolution":{"observed_at":"2026-08-10T22:13:12.584751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.02512","last_updated":"2025-01-05T11:58:40Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-11T16:31:06.736144Z","submitted_at":"2025-01-05T11:58:40Z","title":"Efficient Long Speech Sequence Modelling for Time-Domain Depression Level Estimation"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2501.02512."}