{"as_of":"2026-08-04T08:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f06de5a248748fc4116b81aa1d225d0a383b60cd8f998fd86e941d243bd6d33","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T09:12:17.734060Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T10:03:54.653164Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"cited_work":{"arxiv_id":"2604.22245","doi":"10.48550/arxiv.2604.22245","metadata_source":"pith","pith_arxiv_id":"2604.22245","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","venue":"eess.AS","work_id":"481a0866-4447-4848-b22b-9c555f71692d","year":2026},"citing_paper":{"arxiv_id":"2605.28480","last_updated":"2026-05-27T13:39:14Z","snapshot_observed_at":"2026-07-06T23:38:04.621658Z","submitted_at":"2026-05-27T13:39:14Z","title":"Audio-Mind: An Auditable Agentic Framework for Audio Understanding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-29T10:03:54.653164Z"},"links":{"cited_paper":"/paper/2604.22245","citing_paper":"/paper/2605.28480"},"observation_digest":"sha256:c871af66d558512e76b28429ffbc89aa32c39d7b6e66a769b977e43e7bdffc84","observation_id":"ce687dc8-6093-4861-8d1a-28f5153af99d","resolution":{"observed_at":"2026-06-29T10:13:17.611327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.22245/citation-record","integrity":"/paper/2604.22245/integrity","json":"/paper/2604.22245/citation-record.json","paper":"/paper/2604.22245"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03054","last_updated":"2025-05-12T19:49:55Z","snapshot_observed_at":"2026-07-31T15:21:33.202271Z","submitted_at":"2025-05-05T22:28:53Z","title":"BLAB: Brutally Long Audio Bench","version":2},"cited_work":{"arxiv_id":"2505.03054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03054","snapshot_observed_at":"2026-07-03T07:17:43.943669Z","title":"Smith, Yulia Tsvetkov, and Sachin Kumar","venue":null,"work_id":"d3c2698d-7411-42b6-8b5d-7c9d975adc0c","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2505.03054","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:ffb9fac9dc72839d7150a2789d3b5541258c157b93c97f6b93366c4888b51832","observation_id":"28bdb03b-9f7b-4b0a-8340-93966072b295","resolution":{"observed_at":"2026-05-11T20:26:09.722229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"50c0ca3f-4d44-4792-96e6-b6535d9563b8","year":2023},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:b5f6af3adde421d49f251fa21761fa81b1ac18b94e4b8dc917b39126e3d9068c","observation_id":"85f040b5-bd98-482d-8ece-1a1f953cf26e","resolution":{"observed_at":"2026-05-26T16:22:38.563115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"462eaa80-1c76-4e0f-98b7-a58f5ba4d613","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:4386c9e27b250e2ecf8148618098bef543ce2c8e48114f41b72e8e88b86f5ee6","observation_id":"1bf61a2e-c21a-4c97-8cb4-ced042f6f240","resolution":{"observed_at":"2026-05-26T16:22:38.578391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:7e033188df7257800b3313ad9a67467e6a75bc81219e81907067aa7180507837","observation_id":"9d9bfa7c-b0ad-49d7-ba9e-1f02d9ac913c","resolution":{"observed_at":"2026-05-11T20:26:09.910248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.03983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:39:57.187930Z","title":"Yexing Du, Kaiyuan Liu, Youcheng Pan, Zheng Chu, Bo Yang, Xiaocheng Feng, Ming Liu, and Yang Xi- ang","venue":null,"work_id":"d0297566-406b-428d-8e02-c298bc924506","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:d86ee0606fa830df511d0306bd823e5b993d6ee3d6800611ba972ace83248066","observation_id":"ce644bfd-3696-4ca8-b282-a910ef6f20b6","resolution":{"observed_at":"2026-05-11T20:26:09.807933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"535fca5e-8e84-4b20-abfc-4bdf9568a00e","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:3655a2d1a8242830f5c260f025d52effa4fd8510fb21fcbad139731758a3aff6","observation_id":"d9192e85-4b89-4532-9b99-a83c47ecd51c","resolution":{"observed_at":"2026-05-26T16:22:38.571069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.08011","last_updated":"2017-10-22T20:48:49Z","snapshot_observed_at":"2026-07-06T06:05:25.345700Z","submitted_at":"2017-10-22T20:48:49Z","title":"ActivityNet Challenge 2017 Summary","version":1},"cited_work":{"arxiv_id":"1710.08011","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.08011","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ActivityNet Challenge 2017 Summary","venue":"cs.CV","work_id":"9b9d2b54-75f1-4b41-aa47-ab4046c8cacd","year":2017},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/1710.08011","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:132bb2fd3283c9d6969cb181937ad4011f4bcb9772f0177be370446bb4027a01","observation_id":"0217966b-c841-4afc-aaf8-d1ab2b11bd92","resolution":{"observed_at":"2026-05-11T20:26:09.919153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08128","last_updated":"2025-07-28T22:53:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-10T19:40:21Z","title":"Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models","version":2},"cited_work":{"arxiv_id":"2507.08128","doi":"10.48550/arxiv.2507.08128","metadata_source":"pith","pith_arxiv_id":"2507.08128","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models","venue":"cs.SD","work_id":"67c2892d-8e27-4da1-8198-71c48e673e96","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2507.08128","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:52e84b839ce9793e60ef4ca83554f26236e320ac7f70d6c305823f745686387b","observation_id":"6d269d35-bb44-42ac-beea-70cf62c7ca95","resolution":{"observed_at":"2026-05-15T03:42:46.422993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu, Leonid Karlinsky, and James R","venue":null,"work_id":"83196f09-cfb2-4bdf-a3ad-95406c11fdf5","year":2024},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:a6704ac35fccf954e8d3492cb6b4800925efa26ba8f296c6691d069684707835","observation_id":"937b5950-ad63-4a88-af3c-f5fbcda5efc7","resolution":{"observed_at":"2026-05-26T16:22:38.552091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-07-10T20:07:33.480124Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:9c4ea4979414feb18f65e8dc65c0bc004854e0005965b474ae402c84832f0f56","observation_id":"62de511b-07ad-41de-b536-a69d5d9edf27","resolution":{"observed_at":"2026-05-11T20:26:09.884224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4c39c275-edc1-4417-93f8-d764d615c6e5","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:74ba9f48449ea32d3667d962095828bf8ec0208e63b2d14ad5e44a2e2ef8d43e","observation_id":"47fca88f-3877-41e6-917e-aec61159e086","resolution":{"observed_at":"2026-05-26T16:22:38.556104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ef7a9432-9bf4-4d5b-be77-1766295cc79c","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:a422d40ffb9ee60109d4183584ecca101a4e447e2926f99826e38cf5a5881903","observation_id":"5d7e125e-69ff-4063-a772-bb4bcf4f6dd5","resolution":{"observed_at":"2026-05-26T16:22:38.544247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07293","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:53:55.839119Z","title":"Audiomarathon: A comprehensive benchmark for long-context audio understanding and efficiency in audio llms","venue":null,"work_id":"09d1fac2-ebc7-4758-8efd-e47325ca4f45","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:671c63b4f7c7245502e21e38b316716d660b801975837dd303407114a8ea1028","observation_id":"1843854b-6512-48f2-90a8-c948d0ff8788","resolution":{"observed_at":"2026-05-11T20:26:09.764300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:45:27.556049Z","title":null,"venue":null,"work_id":"8cd733fb-26af-479f-88c2-826f2ab2e5cd","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:6e39a01a5fdf17ed12da1006479d69c0333695a20691c3a1680f1d35774b9fcb","observation_id":"0fcb602e-a89a-4d68-90d5-f33993560b81","resolution":{"observed_at":"2026-05-26T16:22:38.539971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5bb8e1df-98f0-4220-8cf5-fd9bfbd2e5d6","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:cafc14dede95406fbf97ff9220e3aca1b08b084fe5d9f34cdca94e3a233cf2f7","observation_id":"7b494d9a-2b94-495e-98c3-d2400fb62f17","resolution":{"observed_at":"2026-05-26T16:22:38.548264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cad3d126-1624-4b22-a051-073198cd1874","year":2021},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:6dd8f1b59fac981784c9ebdd3a59ed8d5eb428476f3765cb126f400c8a84be34","observation_id":"6129fedc-b798-42c5-88e3-6f08c20932a5","resolution":{"observed_at":"2026-05-26T16:22:38.559693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06896","last_updated":"2026-07-13T07:08:04Z","snapshot_observed_at":"2026-08-03T16:40:19.294525Z","submitted_at":"2026-01-11T12:40:07Z","title":"TagSpeech: End-to-End Multi-Speaker ASR and Diarization with Fine-Grained Temporal Grounding","version":2},"cited_work":{"arxiv_id":"2601.06896","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.06896","snapshot_observed_at":"2026-07-14T02:21:27.159399Z","title":"Tagspeech: End-to-end multi- speaker ASR and diarization with fine-grained temporal ground- ing","venue":null,"work_id":"bf6ef1d6-86a6-4e14-9eab-3621a8144c75","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2601.06896","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:764f64098ed379ff36b619a1ada4fc77c440310b76171aa360239225bd934334","observation_id":"d46c54e6-f72e-4410-8ff5-a74498ba3a84","resolution":{"observed_at":"2026-07-14T02:21:27.159399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.10134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"208ff268-001f-431d-9091-28b4c5028f88","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:3cb95a5275900e3bb5ed06a2a4d4ea86b6eca839613412f8aeee9a2dc229d7b6","observation_id":"d058b83d-d276-47de-9f4d-cd8fde5a469e","resolution":{"observed_at":"2026-05-11T20:26:09.876980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1c117109-4512-4bba-af1b-5d234469a053","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:5a9f7e8c18019e7881e7557cb01c59595479618709bcf27aefde0d1fd407483a","observation_id":"096f21fb-d4d7-4d97-b6c1-4258a0ff47f4","resolution":{"observed_at":"2026-05-26T16:22:38.567663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8f978850-1c72-4631-9dd7-bb7201e937fc","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:a7f66107c52b5cc850697b7a0b407b61ecdce80409a41d80cee908c858f12101","observation_id":"3d1d7d5f-7e15-4a7e-8fd4-654f6ef69d5e","resolution":{"observed_at":"2026-05-26T16:22:38.581679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06199","last_updated":"2026-06-01T03:39:22Z","snapshot_observed_at":"2026-08-03T12:01:57.439695Z","submitted_at":"2026-01-08T07:46:03Z","title":"FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation","version":3},"cited_work":{"arxiv_id":"2601.06199","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.06199","snapshot_observed_at":"2026-07-03T01:37:30.613903Z","title":"FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation","venue":"eess.AS","work_id":"8997388d-332d-4d0c-8b1a-50e04985fbff","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2601.06199","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:f825c8b8d7d769bed86f34b91a022c1282897d4308af09c7af7854f36bf43184","observation_id":"65121701-a23a-493f-9953-646529988d76","resolution":{"observed_at":"2026-06-02T03:04:03.714832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04876","last_updated":"2026-05-27T05:39:51Z","snapshot_observed_at":"2026-08-03T11:56:05.502561Z","submitted_at":"2026-01-08T12:21:09Z","title":"ChronosAudio: A Comprehensive Long-Audio Benchmark for Evaluating Audio-Large Language Models","version":2},"cited_work":{"arxiv_id":"2601.04876","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.04876","snapshot_observed_at":"2026-07-07T14:53:55.862562Z","title":"Chronosaudio: A comprehensive long-audio benchmark for evaluating audio-large language mod- els","venue":"cs.SD","work_id":"20767bd2-9c5e-413b-a479-7c5b281cbdc0","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2601.04876","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:6a97fa20c6c9c2c80b1f195f30506144419febfe62d3f370b0723bebc11fc9a3","observation_id":"ab8c0db5-6649-4536-8fa3-c5e2f634fdc4","resolution":{"observed_at":"2026-05-28T02:04:13.437222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-07-10T13:57:06.708632Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:db5610cb0789bafc8a7ef3c100b47c8d738171f72c50e33464c4b4ef818cbda3","observation_id":"13c11055-8e5c-4df1-ab18-9ae435bd4ad7","resolution":{"observed_at":"2026-05-11T20:26:09.812748Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.18220","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:27:36.597298Z","title":"Available: https://arxiv.org/abs/2601.18220","venue":null,"work_id":"b6812bc0-16d1-443f-a8ad-8ef9e5c81882","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:6e7fd4f04ff864ea66cc18bf2426e2368d7c7f5d26591eb151b865cc4f37bb51","observation_id":"c096c552-f3d8-432a-84ab-dc6522730f03","resolution":{"observed_at":"2026-05-11T20:26:09.775453Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:4fce5e2b25db1c060ed100f9efb7a979a389e337b050b4450214ec800edbf65c","observation_id":"da6a9e21-6375-4021-b2ff-86e48327c7de","resolution":{"observed_at":"2026-05-11T20:26:09.788219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:288cd2b24645dbc2427195e680cfac10df12eb9616c60d4c8c058572c2809cda","observation_id":"855f5c37-db19-43fb-8583-60422c6f04c0","resolution":{"observed_at":"2026-05-11T20:26:09.863032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"23cffa00-09bd-46cf-ba9b-b17dc17633e5","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:efeb92e728143cb946caa6cacba68a9b9bf840f6955cb8ba76fcef9e5e7bd603","observation_id":"40e3cefb-ec58-414b-88aa-22c0bd90dde0","resolution":{"observed_at":"2026-05-26T16:22:38.574551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:a1ab9733004365f7689245868a9648574805a0fde49ad8c68e2d57bce84e44e5","observation_id":"d2b0abd9-3888-4a76-8e65-17715ab283ef","resolution":{"observed_at":"2026-05-11T20:26:09.856788Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f1745b7f-1614-494b-b6e1-12ad95121e17","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:2799a6ca3754a8652b16f6627f0608949a49727500b9c123b82e3fc1c7977bed","observation_id":"e4dd3b58-7c7c-4dfd-87cb-7d45e8b455d7","resolution":{"observed_at":"2026-05-26T16:22:38.585649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23918","last_updated":"2025-07-03T16:49:39Z","snapshot_observed_at":"2026-07-06T21:49:47.325553Z","submitted_at":"2025-06-30T14:48:35Z","title":"Thinking with Images for Multimodal Reasoning: Foundations, Methods, and Future Frontiers","version":3},"cited_work":{"arxiv_id":"2506.23918","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.23918","snapshot_observed_at":"2026-07-11T03:17:51.399835Z","title":"Thinking with Images for Multimodal Reasoning: Foundations, Methods, and Future Frontiers","venue":"cs.CV","work_id":"760ebd7d-977d-4280-afae-adb421d49ed4","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2506.23918","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:2c55d90bdd64fcd93d07330fd7f1e31a7253d6a87a565c2266d9216bde19be94","observation_id":"493fb8d6-fc0c-47ba-99aa-dbb9d02e6b13","resolution":{"observed_at":"2026-05-13T08:34:23.540456Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05373","doi":"10.48550/arxiv.2602.05373","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:37:34.400022Z","title":"Speech-xl: Towards long-form speech understanding in large speech language models,","venue":null,"work_id":"8f71cc96-bd57-46d3-ac5b-444d66001b30","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:8da4108eedcb7a149af69cf93dab2d357c31ac43ffe06f142ff2a2beb68995eb","observation_id":"f56de700-1b19-45aa-b18d-7fb060b1972f","resolution":{"observed_at":"2026-05-11T20:26:09.792883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:e1713c35571d5275a4222088890c37045b0cb42fee2bb3c9840506ab05ae5467","observation_id":"8e977847-a221-442a-ba85-96b516237126","resolution":{"observed_at":"2026-05-11T20:26:09.817373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2509.17765","doi":"10.48550/arxiv.2509.17765","metadata_source":"pith","pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Qwen3-Omni Technical Report","venue":"cs.CL","work_id":"ae43e594-8bab-4471-b6af-92a300f6a048","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:ef2bdb18decdcf9a22714960c7e8e33500b83d6077dff399fca6b52f7846c8d8","observation_id":"731c8b5e-234f-49a5-bd12-f14371639eaf","resolution":{"observed_at":"2026-05-11T20:26:09.840631Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:90967036ca712364c72cffe6f90170fe76aec5cfed4aa3736da97c894efe8683","observation_id":"6eca2b52-19c8-4719-b883-1b1a2d77eb2a","resolution":{"observed_at":"2026-05-11T20:26:09.702347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:2b1606f608a37525d8dd9c948bf492afdc39f23f596b2080e40b1320bc8506c3","observation_id":"0a5aa054-f767-4908-b8ef-8ba03095e87a","resolution":{"observed_at":"2026-05-11T20:26:09.833414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5d7628f7-479a-48e5-8cd9-1bf5c8277f0c","year":null},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:3d7c47c26e33f335c16cc54c9f65dfd9defd46f8cebb405b14c663dfed45f384","observation_id":"a97b3caa-952a-4648-83e3-6b41c3be0006","resolution":{"observed_at":"2026-05-26T16:22:38.589400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.15848","doi":"10.48550/arxiv.2511.15848","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Step-audio-r1 technical report","venue":null,"work_id":"80b24600-9960-4df9-97b2-66714cfd73f5","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:08e183fdc056d6cada3dfcc77f4235de844d9bc583cd1b7906db67f406da5210","observation_id":"2f7a4473-2fb4-43a8-bc1a-9d2abefb9389","resolution":{"observed_at":"2026-05-11T20:26:09.756049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fe5cb26b-6f6d-4e40-9b44-b28c7a0639f3","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:c0285c510711674edd24a69ed481d6d115ac12047136f1061f06bbd600b0f88b","observation_id":"e2c141c0-d823-43e7-999d-761447ee29f2","resolution":{"observed_at":"2026-05-26T16:22:38.604219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aada7d01-ad9d-4974-9f1a-9879bcb88c4e","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:cc7672be531b8aea15c2a9019045cf924359e79df5078ac1238ec2dffd3c2d6a","observation_id":"800120dc-1a3c-4d3c-a3b0-a72106ef780a","resolution":{"observed_at":"2026-05-26T16:22:38.600535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23808","doi":"10.48550/arxiv.2512.23808","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mimo-audio: Audio language models are few-shot learners","venue":null,"work_id":"8c438dfc-e0fb-45e5-983b-3708cd7afa91","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:e5773de66052b7467140920bf847846c3cf8ec02037c01f3c6ef7743f4c43b81","observation_id":"ac90d1a1-05a6-460e-946e-ff4c5db39a2b","resolution":{"observed_at":"2026-05-11T20:26:09.734350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4902f884-8a75-491a-a6a1-ac00a03d0928","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:9c7994899c477e349c9a61cc1110e62c8702e05d4930df358c93a0894199407d","observation_id":"c8e0f8f1-5e20-4a09-a455-2586d34afd53","resolution":{"observed_at":"2026-05-26T16:22:38.608187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13539","doi":"10.48550/arxiv.2601.13539","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"CoRR , volume =","venue":null,"work_id":"f7bca4b2-b306-429f-ad68-54a6eec35888","year":2026},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:f7c96b6b198702257ecee8609a8b319b919bece7cabf0fe5b48cda5052bf816a","observation_id":"ac17adbd-9f3e-4ae4-8f36-a4ee3109b8ef","resolution":{"observed_at":"2026-05-11T20:26:09.827729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ef47d32a-1dc2-4c74-8576-7267a4fc74d1","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:92b1d59ee7268b4659a71d738e9f01f8225038707982ae03fe5cd3d3fe95e309","observation_id":"e7a8fbbb-0863-458e-be32-1305ca089e9e","resolution":{"observed_at":"2026-05-26T16:22:38.593087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20785","last_updated":"2026-05-21T10:39:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T19:22:48Z","title":"LongVT: Incentivizing \"Thinking with Long Videos\" via Native Tool Calling","version":3},"cited_work":{"arxiv_id":"2511.20785","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.20785","snapshot_observed_at":"2026-07-02T23:57:29.009867Z","title":"LongVT: Incentivizing \"Thinking with Long Videos\" via Native Tool Calling","venue":"cs.CV","work_id":"18448f92-5a5c-48d8-bc8e-62464eb1c501","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2511.20785","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:c93b444745920261bdc11df974f598241cbd339938c48d8f2982878007668bfa","observation_id":"c82f0a56-b982-41c8-abe8-02f30c77477d","resolution":{"observed_at":"2026-05-22T02:03:52.219011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04416","last_updated":"2025-09-03T07:11:03Z","snapshot_observed_at":"2026-07-06T22:08:45.542495Z","submitted_at":"2025-08-06T13:03:21Z","title":"Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning","version":2},"cited_work":{"arxiv_id":"2508.04416","doi":"10.48550/arxiv.2508.04416","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04416","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Thinking with videos: Multimodal tool-augmented reinforcement learning for long video reasoning","venue":null,"work_id":"824594ad-21b0-49b7-88f8-fac8553528e3","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"cited_paper":"/paper/2508.04416","citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:439cc7ec04b2b9ed711fcfca83ed804986fd6b7301682e977e0dc0cc92ae0fa2","observation_id":"45b638aa-bc33-4a04-9004-bec1c65f6b51","resolution":{"observed_at":"2026-05-11T20:26:09.890845Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"518cbcd2-fda4-4187-bcdd-6367ebfe245c","year":2025},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:d5c16be7a9872e6d3979ee36f370c0f61b707545a698bcf8651fc1b5426aca9a","observation_id":"07e22af3-6b74-4871-9ce5-ab8ef2b3e468","resolution":{"observed_at":"2026-05-26T16:22:38.596965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3565a87-1ed3-474e-9708-ebb2cbf0ba4f","year":2022},"citing_paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T09:12:17.734060Z"},"links":{"citing_paper":"/paper/2604.22245"},"observation_digest":"sha256:534e6cb5ac7a70617a9962e48d216a2d8985b181bbb3fcf135ac9551be0ac212","observation_id":"f019d7c7-bd04-4a18-88fb-9db503de3441","resolution":{"observed_at":"2026-05-26T16:22:38.611684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.22245","last_updated":"2026-04-24T05:40:46Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-31T18:00:03.614622Z","submitted_at":"2026-04-24T05:40:46Z","title":"Listening with Time: Precise Temporal Awareness for Long-Form Audio Understanding"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":27,"verified_fuzzy":1},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2604.22245."}