{"as_of":"2026-08-17T02:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f954452663164fb17bb3c5ea8d45fca5fdd643ef978785bc5c31685e6337fb26","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:37:42.814958Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.02876/citation-record","integrity":"/paper/1908.02876/integrity","json":"/paper/1908.02876/citation-record.json","paper":"/paper/1908.02876"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.209806Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"4a55a2c1-b655-4aed-b0cb-51016ecbabb2","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.713144Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:481ca152ca0cfb1b6d1280a20459fd8b6af7a75b54d1fabf8c077fe601ae659e","observation_id":"1e106f63-a0a2-484d-b6e7-c0ee05a55eaf","resolution":{"observed_at":"2026-08-14T14:37:43.213799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.197510Z","title":"Acoustic Scene Classiﬁcation Using Deep Neural Network and Frame- Concatenated Acoustic Feature,","venue":null,"work_id":"5fb0cb3b-a242-44d0-a7aa-af2e17db1217","year":2016},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.718930Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:725b5da387823a49b3db9847ccb64df916ae7fe0092daf0e5e80995a0ced58a9","observation_id":"7e4705b5-39e8-497c-b12e-e479241f85b3","resolution":{"observed_at":"2026-08-14T14:37:43.201860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.184825Z","title":"Feature Analysis and Selection for Acoustic Event Detection,","venue":null,"work_id":"15dbad73-10d0-408f-a974-b40e26e77378","year":2008},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.723080Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:b8de70de97a33b9e76d62832b24d61825fcd234d3bb0b8ca9b124a4301819105","observation_id":"e1b87c4b-bf63-44a0-bdf3-a4ec0b9336c0","resolution":{"observed_at":"2026-08-14T14:37:43.189643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.169133Z","title":"Cnn architectures for large-scale audio classiﬁcation,","venue":null,"work_id":"31a18217-cbc1-4ab2-8086-b81448e0ccd3","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.728096Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:45c937d240b13293c74b582a1ed602382f205070a5175e3c87c9b8bb4ebbd8d0","observation_id":"1138f4cc-3410-4b3f-908f-ea7b40cbbd31","resolution":{"observed_at":"2026-08-14T14:37:43.174111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.155136Z","title":"Imagenet classiﬁcation with deep convolutional neural networks,","venue":null,"work_id":"513ea794-1485-458b-bfe0-7bcde47173cf","year":2012},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.732638Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:8849c84638c9a40825a2cbabd45d86b8a2057120ee855f068172a5d783ecdc9d","observation_id":"f853b0bf-d0ef-4701-bb83-327144535d6a","resolution":{"observed_at":"2026-08-14T14:37:43.159827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.140105Z","title":"Audio event and scene recognition: A uniﬁed approach using strongly and weakly labeled data,","venue":null,"work_id":"1430e656-c31a-45b0-b87f-ac5726c8b9d1","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.738311Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:286da1f6d3edee7a652aaae98c9b2e010b21600dfbabf3cc954349a1d7571eb6","observation_id":"23c561e2-1958-4318-a6cf-5383827b2f90","resolution":{"observed_at":"2026-08-14T14:37:43.145629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.02530","last_updated":"2022-10-02T01:27:14Z","snapshot_observed_at":"2026-08-16T22:08:03.139316Z","submitted_at":"2017-07-09T06:16:23Z","title":"Deep CNN Framework for Audio Event Recognition using Weakly Labeled Web Data","version":3},"cited_work":{"arxiv_id":"1707.02530","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.02530","snapshot_observed_at":"2026-08-14T14:37:42.922853Z","title":"Deep CNN Framework for Audio Event Recognition using Weakly Labeled Web Data","venue":"cs.SD","work_id":"7c2afc4d-f88e-4fac-a0de-fb8a8f39f42f","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.745189Z"},"links":{"cited_paper":"/paper/1707.02530","citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:2fd302ac120a816a2483e43dce09c1e3c3b6f3e619e6f876d56ed98b446198e8","observation_id":"55290dac-d6fa-41b4-9304-6ea1070f6cdf","resolution":{"observed_at":"2026-08-14T14:37:42.929804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.123497Z","title":"A ﬁrst attempt at polyphonic sound event detection using connectionist temporal classiﬁcation,","venue":null,"work_id":"01473f0e-bdeb-4927-b007-c267209092cf","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.750490Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:dcbf87921c2497e1920c5524ccbdae28b1eb8fe16893e80ceb91222cab216ec3","observation_id":"93faa945-da6a-49f9-84cd-797bf2a851cf","resolution":{"observed_at":"2026-08-14T14:37:43.129487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.106816Z","title":"Convolutional recurrent neural networks for polyphonic sound event detection,","venue":null,"work_id":"6a172060-2304-40a6-b699-9cdc548a85fe","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.755211Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:14155854eb960b79b4eec3af67c3352de359d244de299dc13cf7c29d5ad5931d","observation_id":"8b605e05-dfce-477f-ad2b-000af15cb802","resolution":{"observed_at":"2026-08-14T14:37:43.112147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.087104Z","title":"Adaptive pooling operators for weakly labeled sound event detection,","venue":null,"work_id":"395b480c-66eb-4b8c-a2f1-cdda393a9bae","year":2018},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.760214Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:b23b9d9328fedd2faedb8ec0802940920aa3de6a6456fc18d7d3d7aa4d9be4d1","observation_id":"e2cc85ff-8739-4f9a-a09e-fc87358b1dee","resolution":{"observed_at":"2026-08-14T14:37:43.093534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.066750Z","title":"Class- aware self-attention for audio event recognition,","venue":null,"work_id":"3d328776-928a-423a-a844-c53be46c7073","year":2018},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.765081Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:97d39e1ab5e878a11f0bc1c98256074ce50373710d0e82f718f34c47cabe57f6","observation_id":"b384b59c-7ce3-4aeb-b8c3-7e4bfee3e9d0","resolution":{"observed_at":"2026-08-14T14:37:43.073598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.049811Z","title":"Learning to recognize transient sound events using attentional supervision,","venue":null,"work_id":"5f76c2a1-fccb-4e9d-aa63-6921be4b854a","year":2018},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.768979Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:ca2bef06591bf1c0d809d212bab9c12f659edb598b91195dd85b468345c2c5a5","observation_id":"01b48b24-0b0e-455f-abee-564b5b12b4a1","resolution":{"observed_at":"2026-08-14T14:37:43.055853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00927","last_updated":"2018-02-07T22:02:38Z","snapshot_observed_at":"2026-08-14T20:17:29.860504Z","submitted_at":"2017-11-02T20:40:29Z","title":"Audio Set classification with attention model: A probabilistic perspective","version":2},"cited_work":{"arxiv_id":"1711.00927","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.00927","snapshot_observed_at":"2026-08-14T14:37:42.895374Z","title":"Audio Set classification with attention model: A probabilistic perspective","venue":"cs.SD","work_id":"c26f27a5-d8c2-4d03-b2e8-b9fb33bbf0c8","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.773573Z"},"links":{"cited_paper":"/paper/1711.00927","citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:ffb470485955bc3ea1740c3a004cb56c8ec39879a85446ed1a675760bee1ada9","observation_id":"9cf46a2a-d7f9-4163-9ae7-093b7b668eb1","resolution":{"observed_at":"2026-08-14T14:37:42.903381Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.033749Z","title":"Tell me where to look: Guided attention inference network,","venue":null,"work_id":"94c11a9c-a219-4c40-815d-3656e4bc3fa8","year":2018},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.778968Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:ef1a65d05ae2a4ecef9477eca76b728d143d6695f379bcafdac88f9ba494b1ec","observation_id":"73fa2ebb-87cb-451a-8374-762e066050e2","resolution":{"observed_at":"2026-08-14T14:37:43.039703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:43.014539Z","title":"Knowledge transfer from weakly labeled audio using convolutional neural network for sound events and scenes,","venue":null,"work_id":"6f7da283-5680-4f2f-a481-6f09e53cd915","year":2018},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.783905Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:94526f3bd87375dcd07754626bddddbc9fef354962d0372e03fb5e1b1ad83b7c","observation_id":"147cac3e-183e-4eab-8da5-77d8a2ce7256","resolution":{"observed_at":"2026-08-14T14:37:43.018982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:42.993297Z","title":"DCASE 2017 Challenge setup: Tasks, datasets and baseline system,","venue":null,"work_id":"7ac0a206-9fa8-493a-a20b-49641d5252ad","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.788020Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:c0fa42fcfdce24f413326d1825c71dcc301108191a8a54cc75c52ee9c24e4f23","observation_id":"1fc5106e-8f1d-47e3-b0ed-bcb59874a62f","resolution":{"observed_at":"2026-08-14T14:37:42.999424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:42.977408Z","title":"Retrieval evaluation with in- complete information,","venue":null,"work_id":"eaacc976-5f17-497b-a683-dc17d501c67d","year":2004},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.793729Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:5362ead1037b7fa87cf436cae14245b821bb6f19051c29fa625b76cf8c6d9c07","observation_id":"b58cab08-07a3-455c-8b26-4fbe78f35a08","resolution":{"observed_at":"2026-08-14T14:37:42.982694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08675","last_updated":"2016-09-27T21:21:49Z","snapshot_observed_at":"2026-08-14T21:37:52.670253Z","submitted_at":"2016-09-27T21:21:49Z","title":"YouTube-8M: A Large-Scale Video Classification Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08675","snapshot_observed_at":"2026-08-14T14:37:42.798659Z","title":"Youtube-8m: A large-scale video classiﬁcation benchmark,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.798659Z"},"links":{"cited_paper":"/paper/1609.08675","citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:28fb6a1355c2260df6fca49a3e818028e14e4cf18c3b0978192cb4e1f77d9339","observation_id":"b56039af-7dec-43fe-bd7f-bfb3b324746c","resolution":{"observed_at":"2026-08-14T14:37:42.798659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09288","last_updated":"2018-04-24T23:04:35Z","snapshot_observed_at":"2026-08-14T19:22:19.659942Z","submitted_at":"2018-04-24T23:04:35Z","title":"A Closer Look at Weak Label Learning for Audio Events","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.09288","snapshot_observed_at":"2026-08-14T14:37:42.805240Z","title":"A closer look at weak label learning for audio events,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.805240Z"},"links":{"cited_paper":"/paper/1804.09288","citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:dcfb3f3085ba0adae6b17b0ac7b5c489887a7f26b1f46b7e95affbb881784182","observation_id":"c350f70d-93d9-4b09-a74c-ec075c3b8ce4","resolution":{"observed_at":"2026-08-14T14:37:42.805240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:42.960549Z","title":"Surrey-CVSSP system for DCASE2017 challenge task4,","venue":null,"work_id":"69865b9f-8379-4501-aa25-736c0a09f885","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.810257Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:f41dfd145cd732178b952c8b8ad42c82147fc982c6787d6cbb0327967608b339","observation_id":"5796a59c-6341-4441-8113-fbd9fcaaaa6a","resolution":{"observed_at":"2026-08-14T14:37:42.967032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:37:42.941293Z","title":"Attention and localization based on a deep convolutional recurrent model for weakly supervised audio tagging,","venue":null,"work_id":"631252d2-db3b-4b8c-9523-3a3e33c2993e","year":2017},"citing_paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:37:42.814958Z"},"links":{"citing_paper":"/paper/1908.02876"},"observation_digest":"sha256:37cbde0b4170976b50eb7d8a23adcee861fc8902a678c640a6949573ce1fa99c","observation_id":"cc549a27-93b4-4644-ad6f-0c00f87441d3","resolution":{"observed_at":"2026-08-14T14:37:42.946022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.02876","last_updated":"2019-08-07T23:48:34Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T15:33:42.155870Z","submitted_at":"2019-08-07T23:48:34Z","title":"Self-supervised Attention Model for Weakly Labeled Audio Event Classification"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:1908.02876."}