{"as_of":"2026-08-07T11:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49c4ea799ffea8af10dab3b59d33d51ca0fc87427d40c001adc8b53ce29644c3","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T14:20:24.828073Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T14:20:24.828073Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T14:25:02.442305Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"cited_work":{"arxiv_id":"2607.06179","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06179","snapshot_observed_at":"2026-07-08T14:25:02.442305Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","venue":"eess.AS","work_id":"1969c977-b571-4980-8c46-ec7e0b4a1ac4","year":2026},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"cited_paper":"/paper/2607.06179","citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:d097b800c1f0e7f7872082a258edfdc5472037075ce25a59551befb20fb655b8","observation_id":"68f5d043-9226-4862-b467-bef6ec5da71e","resolution":{"observed_at":"2026-07-08T14:25:02.443766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.06179/citation-record","integrity":"/paper/2607.06179/integrity","json":"/paper/2607.06179/citation-record.json","paper":"/paper/2607.06179"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"cited_work":{"arxiv_id":"2607.06179","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06179","snapshot_observed_at":"2026-07-08T14:25:02.442305Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","venue":"eess.AS","work_id":"1969c977-b571-4980-8c46-ec7e0b4a1ac4","year":2026},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"cited_paper":"/paper/2607.06179","citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:d097b800c1f0e7f7872082a258edfdc5472037075ce25a59551befb20fb655b8","observation_id":"68f5d043-9226-4862-b467-bef6ec5da71e","resolution":{"observed_at":"2026-07-08T14:25:02.443766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.570359Z","title":"As illustrated in Figure 1, the TriA Pipeline consists of four main stages: Standardization, Audio Activity Detection (AAD), Audio Event Detection (AED), and Filtering","venue":null,"work_id":"fb06f8f5-f29e-4f62-9450-70fb09b1ecc4","year":null},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:a6f70c8e956093927b5867f53f2283f865a0011f7eddddcea1a5a7d142e7176f","observation_id":"5ad48bc4-98a2-4a7f-a5d4-5e478551fdc4","resolution":{"observed_at":"2026-07-08T14:25:02.572084Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.591680Z","title":null,"venue":null,"work_id":"b19a1912-a505-4504-91e3-020a99d15cc9","year":null},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:ec6e4787adc9494989eb69bbd63f5544a5b122f8fe033434b2b76d133c8a2729","observation_id":"4860a9ff-b559-41c5-a79e-0f0ead916de6","resolution":{"observed_at":"2026-07-08T14:25:02.593769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.594691Z","title":"For each task, three experiments are conducted","venue":null,"work_id":"f10ddbae-13fc-45ba-9a91-8639f296d243","year":null},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:87f3e23c5c9891d34472a2b395fca01c5fc129447c9f2f624ab0256e6af7846f","observation_id":"54f1761a-98de-4a6f-b96b-316cb01fc0f5","resolution":{"observed_at":"2026-07-08T14:25:02.597007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.603930Z","title":"It efficiently converts audio collected from various streaming platforms into high- quality training data with event annotations","venue":null,"work_id":"57d00798-42c3-4a4f-bfcf-c8a568c93dab","year":null},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:19a5d1ea32d02bc9b6bec8504264a290e0b33d8d73cb07fb92bc8bd88584452b","observation_id":"ca8344e8-25e7-4d86-a44f-caadbaf301d0","resolution":{"observed_at":"2026-07-08T14:25:02.605664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.577130Z","title":null,"venue":null,"work_id":"70dd361d-c4b4-4058-a8b4-2d0af4f04774","year":null},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:9c6b3c465b18e78fa4f64904c5a5e4f0b30244ef85adc03f0a22c8c7a0d62fdc","observation_id":"afff97c6-594e-43d6-8db8-eeef88bd7bc9","resolution":{"observed_at":"2026-07-08T14:25:02.578551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.575089Z","title":null,"venue":null,"work_id":"a73af56a-55c8-49c5-b1f2-eeda56a82a30","year":null},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:ce79e4c2bf50a553c822613b1405921f0d65adee96ed1075f675488305728f25","observation_id":"91324e0d-e8f0-412d-a7fe-eb347db68b17","resolution":{"observed_at":"2026-07-08T14:25:02.576440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.579498Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"94643b32-381a-49df-b94b-4486cd133602","year":2017},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:46b9494dcb3120b336a076a7696c7bfdc512e3a7bcf44724362c213a6a62c34c","observation_id":"76d4465c-6044-4018-bbbb-a60201b9a07d","resolution":{"observed_at":"2026-07-08T14:25:02.581413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.582264Z","title":"Clotho: An audio cap- tioning dataset,","venue":null,"work_id":"643b546b-0307-4845-aa69-d8e46b89d0bc","year":2020},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:f0f0d63bdaefa494c645f6d0de2ae0530afd9756cce102b93e57e4597ffeca56","observation_id":"7a6c7c52-28e0-4be4-a848-21150da2d042","resolution":{"observed_at":"2026-07-08T14:25:02.584082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.584831Z","title":"Bioa- coustics data analysis–a taxonomy, survey and open challenges,","venue":null,"work_id":"e606fcb9-ff7a-409b-bebc-7e9776b21194","year":2020},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:198047893756c7f65cb598db0ec66b150984e3b6e9e11cd8e8567e51f9d033e1","observation_id":"86742938-78eb-48a8-b3e7-1e7919dab035","resolution":{"observed_at":"2026-07-08T14:25:02.586402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.567718Z","title":"Comparison of feature extraction methods for sound-based clas- sification of honey bee activity,","venue":null,"work_id":"d541b536-c410-449b-8eeb-57ceb21161eb","year":2021},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:3ee28d065b46849a6038d8cc214dce95d54df29cedd52d6906e767867de1a4c9","observation_id":"bfbcd470-c2c3-48c7-a352-3359e151a0f1","resolution":{"observed_at":"2026-07-08T14:25:02.569233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.587218Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":"4bea26b8-e0c1-47fc-825e-b7a31c28bd86","year":2021},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:b5db89416da719f9de6fc00ff0b3b3a406342efa746a63e55c23eccef0988454","observation_id":"11dccf46-5980-4235-b562-78911a1a2e60","resolution":{"observed_at":"2026-07-08T14:25:02.588697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3373.28063","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.439749Z","title":"ESC: Dataset for Environmental Sound Classification","venue":null,"work_id":"f0670cd6-59a8-48d2-94ce-45595e02c599","year":2015},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:f012f677a6af0651b8705fecb14a9343735ff7566f87f59fe01041d397b6ea31","observation_id":"80a216eb-d8a6-4b0f-9830-64aefc9a0899","resolution":{"observed_at":"2026-07-08T14:25:02.441185Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.633464Z","title":"Few-shot class-incremental audio classification using pseudo-incrementally trained embedding learner and continually updated stochastic classifier,","venue":null,"work_id":"b45f343b-7d9d-42c9-9181-c92af73584c4","year":2025},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:7031483224eaa81af6b4aac448627e3b8935f46dbe143854e0ee270f5b4f5801","observation_id":"2734aaf1-d67d-4ba5-ad6d-b0e9cf107bb1","resolution":{"observed_at":"2026-07-08T14:25:02.635551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.628093Z","title":"Benchmark for kitchen20, a daily life dataset for audio-based human action recognition,","venue":null,"work_id":"c0049452-dff6-4dca-a6fe-d9f7c9af39a8","year":2019},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:944c5c442370257527d95cad827624ae79e1194520a906466abe14416592dfb0","observation_id":"8456a3a5-f0f0-4824-ac74-45a7c63b63d3","resolution":{"observed_at":"2026-07-08T14:25:02.629788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.589378Z","title":"Chime-home: A dataset for sound source recognition in a do- mestic environment,","venue":null,"work_id":"f7fd0e76-7d35-4f1d-a4bf-1f9c570d8626","year":2015},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:fe9f0d6f21dca3aa7f35da3bbd3c59aca7eac8ca683db4c10fba3ddd4e6f1da2","observation_id":"7ee23827-6bcf-407b-b055-6bf24b741639","resolution":{"observed_at":"2026-07-08T14:25:02.590828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.638214Z","title":"Few-shot open-set audio classification using attention information-fused prototypes,","venue":null,"work_id":"92936534-fb2a-4cc7-8f41-a459e37ebf10","year":1929},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:75ccbfae69e6cc83b77bf25593398a1cdc4d5c13a77a51313625b31629bdb070","observation_id":"94f503e9-1f7c-43e1-93ee-716eb58af78d","resolution":{"observed_at":"2026-07-08T14:25:02.640595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.625855Z","title":"Panns: Large-scale pretrained audio neural networks for audio pattern recognition","venue":null,"work_id":"49a781a3-ebe4-4f15-8ccd-bd48da39b80f","year":2020},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:d4f36ead3d9c9b2acbcf3e1e814155b832137164bb36facd8de8c71b182ea9c4","observation_id":"a427e31c-9e16-4f1a-8e9f-a087aecfeccc","resolution":{"observed_at":"2026-07-08T14:25:02.627226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.623953Z","title":"Beats: audio pre-training with acoustic tok- enizers,","venue":null,"work_id":"c010c100-fd85-4d4b-a702-7091cbf4323a","year":2023},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:24df901d143b0f7ccf1a79e53703ec7e64553d2fa465b9200c60b7443f71c7c1","observation_id":"7b47c1e8-2c22-42f5-b578-f37d37c19963","resolution":{"observed_at":"2026-07-08T14:25:02.625199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.630529Z","title":"Atst: Audio representation learning with teacher-student transformer,","venue":null,"work_id":"98f24b53-0f42-46ea-998e-25f510baccae","year":2022},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:0f7b909cf0973b78f60cc10c848ee92cb73264592a97037d85d207def4a53167","observation_id":"dba62290-e85c-4a6a-a520-331581b021ea","resolution":{"observed_at":"2026-07-08T14:25:02.632524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.636228Z","title":"Streaming audio transformers for online audio tagging,","venue":null,"work_id":"060593d5-1766-4b22-8ceb-58d9b6159da7","year":2024},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:a8568efacf0d36110cacdf4f3e7384773ab4da493d4b25bf403745a5b250e1e9","observation_id":"fee00b69-a641-4693-b4ca-dd55386cf2c1","resolution":{"observed_at":"2026-07-08T14:25:02.637541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.619798Z","title":"Sound event detection in domestic environments with weakly labeled data and soundscape synthesis,","venue":null,"work_id":"133b2811-d9cf-4db2-a6e3-6b5e9babe07e","year":2019},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:dd453355fabc29699146b074989abc4a9ee124327430d2ab4cbf13787324a670","observation_id":"a3262a87-e7a2-44d5-9ce1-73687bbba080","resolution":{"observed_at":"2026-07-08T14:25:02.621214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.598071Z","title":"Domestic activities clustering from audio recordings using con- volutional capsule autoencoder network,","venue":null,"work_id":"ae62cb5d-d44a-4202-9a2e-4b9c7a101e5c","year":2021},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:ba84c3b51cfcdd79e3cbc842f6d6d609733e4fefb7e50374d1d8ee3f79e9a712","observation_id":"d886c08f-3882-41ef-b51f-dff1e74ebcf2","resolution":{"observed_at":"2026-07-08T14:25:02.600298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.615178Z","title":"A Multi-Task Learning Frame- work for Sound Event Detection using High-level Acoustic Char- acteristics of Sounds,","venue":null,"work_id":"d46672fb-b116-40f9-a084-966927a1bbe5","year":2023},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:ecd4dfa13d85eb9f4a53d06f161cec75c9b332510d811c39f1adf45625d9cbb4","observation_id":"236bab84-eaa0-4478-aaf7-3d20dea7307d","resolution":{"observed_at":"2026-07-08T14:25:02.616958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.617676Z","title":"Leverag- ing audio-tagging assisted sound event detection using weakified strong labels and frequency dynamic convolutions,","venue":null,"work_id":"ce268146-dd3f-4ef6-b141-e188e651ac63","year":2023},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:115d9afbfbbc2824fdbd19fb5c681d192e027cb616969f107ac151018b32b92a","observation_id":"5f81433b-52cf-4196-9722-7cb9dbdc910c","resolution":{"observed_at":"2026-07-08T14:25:02.619119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.572812Z","title":"Htad: A home-tasks activities dataset with wrist-accelerometer and audio features,","venue":null,"work_id":"560fb666-732a-4ae9-a84b-b4c416b38d79","year":2021},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:b7b356451941118e51c295ba115b2ac5483794a23fcfbdd4a78ffe7c71e5937e","observation_id":"0d3ecf81-5a6d-4edc-b8ee-f487a7cc14cc","resolution":{"observed_at":"2026-07-08T14:25:02.574371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.621916Z","title":"The cirdo corpus: comprehensive audio/video database of domestic falls of elderly people,","venue":null,"work_id":"8385b65a-c5cb-4cec-9ee0-2233230a30a0","year":2016},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:3a3ebc5e1c0bf41189fec6b9ab2c23aac4c0c5c359d9e4e391aea44c437d5cd1","observation_id":"460eff82-7bff-49b0-9fe5-5484467d9eb2","resolution":{"observed_at":"2026-07-08T14:25:02.623343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.601195Z","title":"Bi-modal multiperspective per- cussive (bimp) dataset for visual and audio human fall detection,","venue":null,"work_id":"09f2a958-f2a6-4767-9fc2-082b0ee1beb0","year":2025},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:cd1c64cadc56bdaa75d83c758b0e23d19bd6e174b1c86381c5ff099460d87392","observation_id":"8ddd7c4a-fbd4-4e53-ba27-80df4b192b72","resolution":{"observed_at":"2026-07-08T14:25:02.603131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.606555Z","title":"Nonspeech7k dataset: Clas- sification and analysis of human non-speech sound,","venue":null,"work_id":"b1376428-841c-4d1d-b048-581d962aa58b","year":2023},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:81d66c79d752f871125c7f794d67019577fffef7d397cfc8e53a2805d86a6f5a","observation_id":"cf5fc140-34bf-4ee9-9de9-b93e523f416d","resolution":{"observed_at":"2026-07-08T14:25:02.608491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.609563Z","title":"Emilia: An extensive, multilingual, and diverse speech dataset for large-scale speech generation,","venue":null,"work_id":"b17b5261-c69f-4a3f-9810-db4738281896","year":2024},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:06c742acfa5730104c1cf2c541713834caf795afda5565a06c24de3ed0868bf3","observation_id":"46fd950a-5661-473a-bfc7-ae870cd6925e","resolution":{"observed_at":"2026-07-08T14:25:02.611144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04195","last_updated":"2025-08-06T08:25:26Z","snapshot_observed_at":"2026-08-06T17:34:54.346667Z","submitted_at":"2025-08-06T08:25:26Z","title":"NVSpeech: An Integrated and Scalable Pipeline for Human-Like Speech Modeling with Paralinguistic Vocalizations","version":1},"cited_work":{"arxiv_id":"2508.04195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.04195","snapshot_observed_at":"2026-07-08T14:25:02.434510Z","title":"Nvspeech: An integrated and scalable pipeline for human-like speech modeling with paralinguistic vocalizations","venue":"cs.SD","work_id":"c4a043ef-1a77-44f9-acec-11c81b7809e4","year":2025},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"cited_paper":"/paper/2508.04195","citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:5284172aabc0032b444967264b031d626174d285cebad49db3e86ef99d1aae7c","observation_id":"780fd3bc-2880-4093-a9f3-601039e19f43","resolution":{"observed_at":"2026-07-08T14:25:02.436023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.05385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.431484Z","title":"A scalable pipeline for enabling non-verbal speech generation and understanding","venue":null,"work_id":"e900e5c5-d317-479f-a7ed-77199ac289b8","year":2025},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:342d7015786240c08ba074627604c9d6c26bfab7b3c3917a29f51c649ca93aef","observation_id":"6bdaafff-d859-4285-b6f6-39844be3189c","resolution":{"observed_at":"2026-07-08T14:25:02.433251Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":"2502.05139","doi":"10.48550/arxiv.2502.05139","metadata_source":"pith","pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","venue":"cs.SD","work_id":"7cba92d8-f51e-4a64-8d1d-6d4cf1f56377","year":2025},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:3b95b48466dd9947368035dae857c3de833b449dc754caf62126b82363fb6c11","observation_id":"b8bebbc3-730e-49bb-a052-e0b7737eba4d","resolution":{"observed_at":"2026-07-08T14:25:02.438599Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.612007Z","title":"Clap learning audio concepts from natural language supervision,","venue":null,"work_id":"bc0972ba-bebc-4280-8b5d-388df10ed100","year":2023},"citing_paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-08T14:20:24.828073Z"},"links":{"citing_paper":"/paper/2607.06179"},"observation_digest":"sha256:3c2ca8c609190bdb673efbf8df6c113bc53ed2b497a5f54b700cedb467c60eca","observation_id":"d0f0ecfc-360c-481b-8a4d-a6f585af3a95","resolution":{"observed_at":"2026-07-08T14:25:02.614393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06179","last_updated":"2026-07-07T11:57:26Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T18:42:45.664566Z","submitted_at":"2026-07-07T11:57:26Z","title":"TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":4,"verified_fuzzy":25},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2607.06179."}