{"as_of":"2026-08-09T22:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:74d478aa72472af2774c92f246b48ab69f2949b6409217ef81e9b510b1c3222f","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T11:28:14.840283Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:20:54.642591Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:24:21.264830Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"cited_work":{"arxiv_id":"2601.06550","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.06550","snapshot_observed_at":"2026-07-07T04:17:58.620756Z","title":"Llm- track: Semantic multi-object tracking with multi-modal large language models,","venue":null,"work_id":"5d22d3b7-071a-4188-a3ea-ca339ca69dfb","year":2026},"citing_paper":{"arxiv_id":"2606.29357","last_updated":"2026-06-28T12:12:18Z","snapshot_observed_at":"2026-07-07T00:03:21.717191Z","submitted_at":"2026-06-28T12:12:18Z","title":"Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T07:20:54.642591Z"},"links":{"cited_paper":"/paper/2601.06550","citing_paper":"/paper/2606.29357"},"observation_digest":"sha256:b00cf12e2c94122e7392f50008a9935fb5e8934af8842dcf29782c00ddabc2be","observation_id":"e495ff10-cd13-40e0-8374-287c2c771147","resolution":{"observed_at":"2026-07-07T04:17:58.620756Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.06550/citation-record","integrity":"/paper/2601.06550/integrity","json":"/paper/2601.06550/citation-record.json","paper":"/paper/2601.06550"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.23661","last_updated":"2025-12-14T14:18:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-28T05:52:55Z","title":"LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23661","snapshot_observed_at":"2026-08-03T11:28:04.980968Z","title":"arXiv preprint arXiv:2509.23661 (2025) 2, 3, 4, 11, 24, 35, 36","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:04.980968Z"},"links":{"cited_paper":"/paper/2509.23661","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c6f48deeda945a9dcdcdb693a55bfece8660a677957a2612dbedafb92a4b26c1","observation_id":"a56e1fd8-4266-4845-a1f8-4e3861645a2d","resolution":{"observed_at":"2026-08-03T11:28:04.980968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:05.123595Z","title":"In: Proceedings of the acl workshop on intrinsic and extrinsic evaluation measures for machine translation and/or summa- rization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.123595Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:b4f3cfc85626c252d8ec3d8865c2d2a159175b127ce208718f8585463447b155","observation_id":"1c58c8e2-8a44-4864-9c62-e658f94f0961","resolution":{"observed_at":"2026-08-03T11:28:05.123595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:05.232807Z","title":"In: 2016 IEEE International Conference on Image Processing (ICIP)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.232807Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:32dac01a5a95b08f5b4b9e6300aa3599fdc5b99af583491de1221f143948fa28","observation_id":"166ce73b-3bc9-4bb8-969f-954228f2fbf6","resolution":{"observed_at":"2026-08-03T11:28:05.232807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:05.391138Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.391138Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:ea7eb2bd2367efd07f8a4d8874de27381198f972bf5c6e3b2e941ef3b9f49c68","observation_id":"7fca1b92-1c18-486e-b539-dbbcdf8a5119","resolution":{"observed_at":"2026-08-03T11:28:05.391138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-03T11:28:05.491861Z","title":"arXiv preprint arXiv:2402.11684 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.491861Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:42f16e22b6d2288bb55cc52dc1b743e6c0cab98fcaea2d55965ab203e265f507","observation_id":"3142315b-10aa-4957-acab-53d14926c21f","resolution":{"observed_at":"2026-08-03T11:28:05.491861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:05.572389Z","title":"In: Eu- ropean Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.572389Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:b1b4a4f2934f39784a34ebd632aac5cbfa232c6f87bccf93a19fc18afd84aee0","observation_id":"bddb38cb-16ef-4b0c-bbe5-2d5b693206b9","resolution":{"observed_at":"2026-08-03T11:28:05.572389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:05.716604Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.716604Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:d6f6c53fb20fb5f5545d0ea558c660cdfbdd75d0e9add1fb9d1d63d2928a3d5d","observation_id":"4c7d6589-d049-4e50-8a37-9c503b5f54d4","resolution":{"observed_at":"2026-08-03T11:28:05.716604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.09003","last_updated":"2020-03-19T20:08:24Z","snapshot_observed_at":"2026-08-01T23:12:45.187111Z","submitted_at":"2020-03-19T20:08:24Z","title":"MOT20: A benchmark for multi object tracking in crowded scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.09003","snapshot_observed_at":"2026-08-03T11:28:05.823046Z","title":"arXiv preprint arXiv:2003.09003 (2020) 6","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.823046Z"},"links":{"cited_paper":"/paper/2003.09003","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:14dba3706e5fc2a21591d9d9f187fbcbf75dd3e9457ceacfd10a4cebc43095df","observation_id":"d88fa1f3-b20c-4bf1-90ae-281804057320","resolution":{"observed_at":"2026-08-03T11:28:05.823046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-03T11:28:05.960458Z","title":"arXiv preprint arXiv:1810.04805 (2018) 4, 11","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:05.960458Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:79bc6bb58a61c2988518c25ff500ea36644d2b0dc53e39f1381654a2e640e9fd","observation_id":"4610ba2c-49d8-4473-8de6-1d0ce78701cc","resolution":{"observed_at":"2026-08-03T11:28:05.960458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:06.092741Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:06.092741Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:55f61d5d86c557c22567b60447984a175d6b6d0f59936aca95c7e780542c4f9b","observation_id":"20ca1e64-7c0b-491a-94ae-9c9568610674","resolution":{"observed_at":"2026-08-03T11:28:06.092741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:06.202853Z","title":"Advances in Neural Information Processing Systems36, 27092–27112 (2023) 2","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:06.202853Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:a0f847e7ddc55f1ee0682c911091d680dfdc39fdd0541b9001c12f3d33ffad79","observation_id":"6a39f821-1425-4c4c-a2e5-0a8eebe060de","resolution":{"observed_at":"2026-08-03T11:28:06.202853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:06.352760Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:06.352760Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:de378a4494bb2840a3e081a4fe1d05ab67f69483f1a203f8e8d2e98d1d605e35","observation_id":"cc2cec5c-6b75-4f91-81cc-e1c9a6e8097c","resolution":{"observed_at":"2026-08-03T11:28:06.352760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08430","last_updated":"2021-08-06T03:22:14Z","snapshot_observed_at":"2026-07-06T11:30:06.143581Z","submitted_at":"2021-07-18T12:55:11Z","title":"YOLOX: Exceeding YOLO Series in 2021","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08430","snapshot_observed_at":"2026-08-03T11:28:06.582603Z","title":"arXiv preprint arXiv:2107.08430 (2021) 12","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:06.582603Z"},"links":{"cited_paper":"/paper/2107.08430","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:8628cf4af38b22a12381da6fab9af3363e9e83947514d62dd1129c2d6a2f8bb4","observation_id":"b1df02c5-233b-4465-8cd9-4bf6c0cf97e9","resolution":{"observed_at":"2026-08-03T11:28:06.582603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:06.807272Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:06.807272Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:af8539e74bcdc796e1cdb3da2ce51b8a86ddd2768cdbcc4c5db148f4f7aceb33","observation_id":"de809c64-c6c5-416c-a276-b56e1ebba91a","resolution":{"observed_at":"2026-08-03T11:28:06.807272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:06.888454Z","title":"In: ICLR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:06.888454Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:6049577f64952d8fa963219edd65224d6fabc02399060a89cd21f1801cbc961a","observation_id":"88161803-cbad-4717-9fee-3f2eb5aefab2","resolution":{"observed_at":"2026-08-03T11:28:06.888454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-03T11:28:07.041554Z","title":"arXiv preprint arXiv:2001.08361 (2020) 2","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.041554Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:ad6e1810042840d08539f34305569470bf6264dce496e437d1b5a7cac14500d9","observation_id":"0bbbc649-3110-46c1-ac04-6fe6c45054a4","resolution":{"observed_at":"2026-08-03T11:28:07.041554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-03T11:28:07.153926Z","title":"arXiv preprint arXiv:2408.03326 (2024) 2, 3, 4, 11, 24, 35, 36","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.153926Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:8bf3b7833666d7874622d0e25a1ba034a68db49dc3dbdac63f9582d36e1fdc1a","observation_id":"cd13daf9-15ef-40f2-bc38-7e17d311ffb0","resolution":{"observed_at":"2026-08-03T11:28:07.153926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10616","last_updated":"2025-03-30T17:15:53Z","snapshot_observed_at":"2026-08-07T17:06:12.190642Z","submitted_at":"2025-03-13T17:56:10Z","title":"OVTR: End-to-End Open-Vocabulary Multiple Object Tracking with Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10616","snapshot_observed_at":"2026-08-03T11:28:07.301754Z","title":"arXiv preprint arXiv:2503.10616 (2025) 12, 13, 31, 34","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.301754Z"},"links":{"cited_paper":"/paper/2503.10616","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:8b2f6a52db73abc1fb42a9fb1e911702934eaa86ed35f40bd7aba11bd9e04275","observation_id":"8492a9c0-01a2-445d-921c-74383fdd51a2","resolution":{"observed_at":"2026-08-03T11:28:07.301754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.422060Z","title":"Science China Information Sciences 68(10), 200102 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.422060Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:94ae6be8ff3d9498d5accf40b94ff24ceefdafb93dd8793dbcfac2c133969f0d","observation_id":"72d2b061-de22-4130-ac57-0b5f0e72b42d","resolution":{"observed_at":"2026-08-03T11:28:07.422060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.565020Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.565020Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:60b6088385167112a8d14b5cef84ed9f373601a9b76a322ea23f5401bb25b75b","observation_id":"de4884fe-76a7-4ffc-bae9-b87d7ce2c508","resolution":{"observed_at":"2026-08-03T11:28:07.565020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.681372Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.681372Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:977b0e2224fbafea57a668d920f2a3216fa31e371e247ee771932689f413afd4","observation_id":"fa767dc3-e080-4a1f-8f13-e794af51c604","resolution":{"observed_at":"2026-08-03T11:28:07.681372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.738597Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.738597Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:052b1630de71acff4012847be11f1a636f54aedda8e6e2ec1385934b18f41c6a","observation_id":"2340fbcf-4f3c-47a1-9423-3a82b6fc4c88","resolution":{"observed_at":"2026-08-03T11:28:07.738597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.784643Z","title":"IEEE Transactions on Industrial Informatics pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.784643Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:9708334734790ff4d16b787742b0267cd41ba6b2513b8798e6e1f8d6df707256","observation_id":"9e0338dc-70f7-42b6-b045-5c5fba600bc5","resolution":{"observed_at":"2026-08-03T11:28:07.784643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.867946Z","title":"IEEE Transactions on Industrial Informatics (2025) 7, 10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.867946Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:743b91d04c0c55ce392391a962edce4fb901e890e5de5a25db1fdf3210bd88e3","observation_id":"5d6d1a55-d800-4760-80c2-b7f39f197aeb","resolution":{"observed_at":"2026-08-03T11:28:07.867946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:07.950728Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:07.950728Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:21475b2c67bd878fbf5522264d6cc015a3e9c18d9a69c618547cbef740209866","observation_id":"cd0753cb-e5d9-4e98-bca5-47f4b2175db8","resolution":{"observed_at":"2026-08-03T11:28:07.950728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.007491Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.007491Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:e58885270d96dd91167b08bab643f7cc9bbec64bd7f0c54f5d34ec9a6ccef9f9","observation_id":"4efd89b6-2634-4579-b0d7-7edf93d2c406","resolution":{"observed_at":"2026-08-03T11:28:08.007491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.117648Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.117648Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:1e153c3d3df7a2a469d74e1b93e329e311f81bcabce03d487e2a315010e1569b","observation_id":"c4df5ea6-e871-414d-8cf8-355a84acfc4a","resolution":{"observed_at":"2026-08-03T11:28:08.117648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.270699Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.270699Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:aebc944dcb8fa18c1d64f8d4e1421bf96573137035b62a8b7be515781b853e47","observation_id":"487b7dde-20e0-41e6-a31b-d3f2a91e2d7d","resolution":{"observed_at":"2026-08-03T11:28:08.270699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.413569Z","title":"International journal of computer vision129, 548–578 (2021) 11","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.413569Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c945427774def6b1229837f750c8f7aa0baafc5e2d63e3a6ef98bd2fd3adb5da","observation_id":"549d71aa-9646-47b5-903c-ed94da2887d5","resolution":{"observed_at":"2026-08-03T11:28:08.413569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.494362Z","title":"arXiv preprint arXiv:2511.17681 (2025) 1, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.494362Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c706439772008e5e3748510853c027d01e69269f5ac1ca3a8d7b39490ac54e8c","observation_id":"51675628-f3a4-4bfe-9fe3-9a8754a12d5f","resolution":{"observed_at":"2026-08-03T11:28:08.494362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.601462Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.601462Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:45cfd12984479a4a9442d4f6c0dfb09a48af6b8b193a22a45950eb9e6e6a8c80","observation_id":"ba67c6d7-6492-40b8-922e-83c002a3538b","resolution":{"observed_at":"2026-08-03T11:28:08.601462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.658613Z","title":"In: 2023 IEEE International conference on image processing (ICIP)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.658613Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:219b76dd5fef212d8c70e9c2664aaeb39fb4c303f25c86ec2b8e678ef259d24d","observation_id":"9c9703a4-3349-47d3-890d-a2e42f249e00","resolution":{"observed_at":"2026-08-03T11:28:08.658613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.741609Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.741609Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:b9a8525b9c0f668348e1d34c1197aab72ce58beffb64db9f4263e0241a9dfa8c","observation_id":"5939f4c1-b56e-44a0-8362-cacc8494170b","resolution":{"observed_at":"2026-08-03T11:28:08.741609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.799741Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.799741Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:8843cd444751265fc271c0e4b5c229512b0038ba6ba8f32d7d2a39271d2248ed","observation_id":"d46eb008-f58c-4b58-bd16-487b73ddbbde","resolution":{"observed_at":"2026-08-03T11:28:08.799741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.843059Z","title":"Advances in Neural Information Processing Systems 36, 3205–3219 (2023) 6","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.843059Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:65e047b2dc4a86bb6edfa26a7c95cbdb325a5810f1d68aef4f14cdff21a5a3df","observation_id":"2b32be2a-f8c8-4292-8b9c-a3d11563fec6","resolution":{"observed_at":"2026-08-03T11:28:08.843059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.904458Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.904458Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:4a89fac0c6ce33b942c27b710b12b70b015e31f1e098f31e8a1fcd1f6335a3c7","observation_id":"4aabf3fa-2841-496b-ac1b-ac9d332d8c0a","resolution":{"observed_at":"2026-08-03T11:28:08.904458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:08.978111Z","title":"In: Proceedings of the 40th annual meeting of the Association for Computational Linguistics","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:08.978111Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:bb9cfa7f06cf808bd55711a0b66f484444ade8e06be59a5f9f93962f1c71c1c9","observation_id":"7648ab2c-77e3-41a2-9d6a-0a466cd63928","resolution":{"observed_at":"2026-08-03T11:28:08.978111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.061447Z","title":"Advances in neural information processing sys- tems32(2019) 11","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.061447Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:e6bbda01912e7d6307405242eb4fe90e11b005f90c2110de4cf5d777c9c0880a","observation_id":"946bf67e-690a-42fd-aeca-aba6d2affac1","resolution":{"observed_at":"2026-08-03T11:28:09.061447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.172173Z","title":"Available at SSRN 5541079 (2025) 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.172173Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:20811271a6c50448fe25e07b78a0f76dbc90be511c6e9348194e24aa624d60b6","observation_id":"b978a510-dac0-453a-8fec-6e033db88579","resolution":{"observed_at":"2026-08-03T11:28:09.172173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.294517Z","title":"IEEE transactions on pattern analysis and machine intelligence39(6), 1137–1149 (2016) 9, 12","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.294517Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:f798600a70545d2e5a9a3520e9a644d4fe4697c90aeecb52c3c222a8b0e0fef0","observation_id":"2728c07d-a994-4039-9c69-e7fa6bbe1f8e","resolution":{"observed_at":"2026-08-03T11:28:09.294517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.416622Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recog- nition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.416622Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:e34d7b70ff365ee13ec91ff9aaa1fb5de53bfde34acd7cef599997daef13b6df","observation_id":"b9f6fc9d-8275-4ee3-9c5d-acf813f151bf","resolution":{"observed_at":"2026-08-03T11:28:09.416622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.539601Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.539601Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:75982a0776a440f5447dce6e44295b1963f33140088f5e74b3fe9c88b7c8e537","observation_id":"bedcf7a8-4c78-446f-81ac-6139fafa7ab7","resolution":{"observed_at":"2026-08-03T11:28:09.539601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.657713Z","title":"In: 2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.657713Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:9c5ba6dcb24ee9633e565846cb01a5b56f50604b6dd596e244a4d9a06910eef4","observation_id":"aa835aa9-0e1f-489a-a4d8-f4e481ef7c94","resolution":{"observed_at":"2026-08-03T11:28:09.657713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15460","last_updated":"2021-05-04T15:58:37Z","snapshot_observed_at":"2026-07-06T10:28:58.102232Z","submitted_at":"2020-12-31T06:03:00Z","title":"TransTrack: Multiple Object Tracking with Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15460","snapshot_observed_at":"2026-08-03T11:28:09.804428Z","title":"arXiv preprint arXiv:2012.15460 (2020) 24, 30, 32, 33","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.804428Z"},"links":{"cited_paper":"/paper/2012.15460","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:7f298a930af6e21cf04fc2e91cc9775bdcead575807392676ce961b318a6daaf","observation_id":"7b7a997d-6e55-4aa3-9ecd-2f78058700b1","resolution":{"observed_at":"2026-08-03T11:28:09.804428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:09.925530Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:09.925530Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:20cc97865354a15de1eac2a66c6ad2cf82297f511ad5e92ff5228413aaf9e6ae","observation_id":"d7a3f428-f35d-4b03-86ba-acacb2ebf816","resolution":{"observed_at":"2026-08-03T11:28:09.925530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-03T11:28:10.006996Z","title":"arXiv preprint arXiv:2403.05530 (2024) 2, 4, 33 18 F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.006996Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:92e2180b81cbe2bc56417acb1b8c7e4db50b1a20e2be171e8d294ba4578a5927","observation_id":"a33adc67-b804-48eb-8c13-93d97fc9ceeb","resolution":{"observed_at":"2026-08-03T11:28:10.006996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-09T02:25:55.181285Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07900","snapshot_observed_at":"2026-08-03T11:28:10.091739Z","title":"arXiv preprint arXiv:2506.07900 (2025) 6, 35, 36","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.091739Z"},"links":{"cited_paper":"/paper/2506.07900","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:90eb0759a384f5c7f3db5c535e9ce78aa4ae9f7b336597bb8313818204c1f058","observation_id":"5de5ce09-d461-4f75-950b-715e05a0634d","resolution":{"observed_at":"2026-08-03T11:28:10.091739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:10.115929Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.115929Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:f628f7c3c6853205d1459eb0b383326d2493741ce8c1c32ad289aaaeb82a49bd","observation_id":"63d38b8c-4882-4f83-b5fc-d232ad4d807c","resolution":{"observed_at":"2026-08-03T11:28:10.115929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:10.253996Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.253996Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:576b5cc0f040731ffdf7a7231a5ccd2a7969370296d4347ff72d771b53bd344f","observation_id":"6796f7f7-464b-4569-99ea-54a696dbe419","resolution":{"observed_at":"2026-08-03T11:28:10.253996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-03T11:28:10.405323Z","title":"arXiv preprint arXiv:2409.12191 (2024) 2, 11, 35, 36","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.405323Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:6323b2382c915840e97cb8acabf2933e85f5ba3708451f593d6a9763cbbed936","observation_id":"6a9a8060-4b26-4dcc-a2b6-d568a9b38a0e","resolution":{"observed_at":"2026-08-03T11:28:10.405323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:10.540131Z","title":"In: The Thirty-ninth Annual Conference on Neural Informa- tion Processing Systems 2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.540131Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:80a0358e03e74bc6ed8ff23e2bf948b40277324066cf3520b8884a328318e217","observation_id":"dc9bbe36-0ef2-4a7e-a919-928db0eaf0c0","resolution":{"observed_at":"2026-08-03T11:28:10.540131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-03T11:28:10.716635Z","title":"arXiv preprint arXiv:2508.18265 (2025) 35, 36","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.716635Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:ea9c97750d72693210b2787c625608b6011288d005df0231c0eb28b0b9f8e710","observation_id":"bf0e330e-d1db-4baa-8a12-4538dcc6c119","resolution":{"observed_at":"2026-08-03T11:28:10.716635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:10.851808Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.851808Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c1dcfa28fc50d89cc847d6b8612e7a5df604d32c6a156a5b149377fab3020386","observation_id":"11a4d1ea-eb89-4ac8-ae35-676b6cf4c827","resolution":{"observed_at":"2026-08-03T11:28:10.851808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-03T11:28:10.989364Z","title":"arXiv preprint arXiv:2206.07682 (2022) 2","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:10.989364Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c72aca478459ba89274cf02a09b5f56d4f93be46fe6b3f52e8429233e483b186","observation_id":"3379b5f8-0c03-48b1-955a-b39812a63abd","resolution":{"observed_at":"2026-08-03T11:28:10.989364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:11.098528Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.098528Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:988a0f788f51a6cd96ebd942099ad1df5878b5f089501cd3b80c116cb8e136c4","observation_id":"019cdbf6-4e3d-4d9a-8d2a-13d7db88c651","resolution":{"observed_at":"2026-08-03T11:28:11.098528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:11.270749Z","title":"Neural computation1(2), 270–280 (1989) 26","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.270749Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c3240b675204f26c15e0bfdae3406460132a1ea166e68ab6bb311ddb41e58630","observation_id":"280d1e9b-9d9a-435e-91bd-94bf34f3cd5c","resolution":{"observed_at":"2026-08-03T11:28:11.270749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:11.434154Z","title":"In: 2017 IEEE international conference on image processing (ICIP)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.434154Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:ff27c7603819901c432b335eb4bce3e2442672f6eac6fc10f0808d43573ded4c","observation_id":"a45ec262-6395-4897-bb65-96df50db3c6e","resolution":{"observed_at":"2026-08-03T11:28:11.434154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:11.550123Z","title":"In: Proceedings of the ieee/cvf conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.550123Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:ec471ec4b7f430481fe219fdec9dd31f45e78ad3a0563a9a603ac72238be0a8c","observation_id":"1778977d-439a-4905-ac82-a21ed0ecdbcd","resolution":{"observed_at":"2026-08-03T11:28:11.550123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T11:28:11.643229Z","title":"arXiv preprint arXiv:2505.09388 (2025) 2, 3, 5, 11, 35, 36","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.643229Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c43ddf4f4db503d00e3df45ab155cf383d73329da6ed38c627b11c89418f4d05","observation_id":"890cc2c6-a4c7-40d6-a6a1-b6a3723ee60b","resolution":{"observed_at":"2026-08-03T11:28:11.643229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:11.788710Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.788710Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:2a3d07a17771668596ed35c2988839b2d8ca07aeb533628c93af50d7665b2346","observation_id":"d920307c-fa6e-452f-b24a-c3abb47af2c3","resolution":{"observed_at":"2026-08-03T11:28:11.788710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:11.901190Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:11.901190Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:410b72f49521b0fe8a7463bc73209c525720fa9cdac8d7e699da1c631aa64caa","observation_id":"8e98b622-878b-42ea-bbb4-c7d9774acafd","resolution":{"observed_at":"2026-08-03T11:28:11.901190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-03T11:28:12.065140Z","title":"arXiv preprint arXiv:2602.15763 (2026) 33 LLMTrack 19","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.065140Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c430cebb1b04ca57d0402681856f88ab8d814dee81f62a50283b5d8827f29946","observation_id":"9b6caaa8-c6a7-4209-9283-7f7ce79136c5","resolution":{"observed_at":"2026-08-03T11:28:12.065140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.232010Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.232010Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:53a4cb3da210dc609508c9e06f9888cf40f9bed1681ecd46a58601a1a0c2c07d","observation_id":"460cc525-ee3b-48a5-91e2-d6ee05ef0d01","resolution":{"observed_at":"2026-08-03T11:28:12.232010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.343824Z","title":"In: Proceedings of the 33rd ACM International Confer- ence on Multimedia","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.343824Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:29d1dc3ad58524db07025a77dd1a1d6a6a81880eb2e2d64151c4fa97a2f1d135","observation_id":"de9ba278-f0fe-4757-a712-691e0b078071","resolution":{"observed_at":"2026-08-03T11:28:12.343824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.430425Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.430425Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:7f29f59e53b2e7ce19abcd33a94da4221a894e23a2a881b5da9fd34394acb979","observation_id":"c10f3d70-cbf7-4bd7-a5fa-4902dd47f503","resolution":{"observed_at":"2026-08-03T11:28:12.430425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.515174Z","title":"arXiv preprint arXiv:2510.13235 (2025) 1, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.515174Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c44c7d6c6c19eafbde3effbca10d3c8006460a2f8ba21de15a8f376c37561d48","observation_id":"5efc5fad-c223-42d5-aa52-45d921e4516f","resolution":{"observed_at":"2026-08-03T11:28:12.515174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.627969Z","title":"interaction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.627969Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:97ebd195cd5cfc43e8cd5d06531c7dc88f72bde41bf594afd83f15a59b9ab1db","observation_id":"459d6a56-9308-4e56-bd24-25b48d1fcc9c","resolution":{"observed_at":"2026-08-03T11:28:12.627969Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.706787Z","title":"For example, a single GT cyclist (ID 73) might be predicted as two separate tracked IDs (ID 3 and ID 6)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.706787Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c1c40321fcc7cf8aa7c4b13bf47c1102c652ac0d9535f741b3efdee719eccfe6","observation_id":"aee4509e-57cd-4889-ae80-137de7b239e9","resolution":{"observed_at":"2026-08-03T11:28:12.706787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.795135Z","title":"Under standard protocols, the absence of a prediction would result in a zero score for the corresponding GT caption, dragging down the overall semantic average","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.795135Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:6cebcfa6ab0d1716cc9baf66809369f908816f95655a99a773e6b824ad2dd673","observation_id":"74800bb2-1eed-45b5-a82d-7f5d0eac19bc","resolution":{"observed_at":"2026-08-03T11:28:12.795135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:12.901572Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:12.901572Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:c121c108a8ae02fbcfc24bfd3fe4e7ed57f297ecab94ea689ea7b560998b4655","observation_id":"f51630a6-0694-4c76-b469-b3ee5a4da70c","resolution":{"observed_at":"2026-08-03T11:28:12.901572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.108741Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.108741Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:75bdd027a904d18534e2fcfdb702077c2effd83fca34c70ad8600ee2f4a9712c","observation_id":"f8a63c2d-7682-4744-be5a-92a3ed13b2f3","resolution":{"observed_at":"2026-08-03T11:28:13.108741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.305184Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.305184Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:7d34409adbafe04058103d827e30003e464ad43310dbaecad5e67c3bfb1ebc81","observation_id":"5f5d12bb-b323-4a68-870d-da2e44fc3c61","resolution":{"observed_at":"2026-08-03T11:28:13.305184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.414244Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.414244Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:2a0681a56935e7cbba7e4476ab81237d7051fde270d0a32cbaaa525c4ca7845f","observation_id":"bf9b7ac5-97ea-41e6-8db4-40b05473cfb5","resolution":{"observed_at":"2026-08-03T11:28:13.414244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.524331Z","title":"Based on the provided video frames and the orig- inal instance caption, generate a more detailed description for this specific instance (object/person/animal)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.524331Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:dd1627f5069822b7202204105f93bc86dcba15c7909a699f2bf109bcf4ec53df","observation_id":"304152ee-6fe3-4c31-bd57-8165a0337c4b","resolution":{"observed_at":"2026-08-03T11:28:13.524331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.609267Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.609267Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:dff6403cf1b64aba6f1e2e94c5d662928dca0d4656a761690a123e6b37a540d7","observation_id":"08b98845-0414-40fc-af6d-0e95c62002d9","resolution":{"observed_at":"2026-08-03T11:28:13.609267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.731021Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.731021Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:444883d73b1f27a73a72ecb51c67c829d7d13c7b43cf28db9fb08aefd5806073","observation_id":"503481f7-092a-4880-a88e-9c6b4f33a5c6","resolution":{"observed_at":"2026-08-03T11:28:13.731021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.815845Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.815845Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:7067722333046050cbec5887b5c27f9a5fbf870ed94717064446e9a0bcff918a","observation_id":"f285868b-31f8-452c-8621-67882fc3200c","resolution":{"observed_at":"2026-08-03T11:28:13.815845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:13.890814Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:13.890814Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:51ee4f9389dec5c2f075a68bf84e1f9c4ddd449717ad0822ea5674515a20bcb7","observation_id":"03086edd-0032-4480-9ce7-354ca8b8511d","resolution":{"observed_at":"2026-08-03T11:28:13.890814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.034907Z","title":"appears to","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.034907Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:019492b01ac177c2bf292c4c8655e4f82fbe7e1b4de063877dcee48badab770c","observation_id":"0b3bc884-f121-4c17-89cf-d3b6431e70b8","resolution":{"observed_at":"2026-08-03T11:28:14.034907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.120216Z","title":"Do not browse the web or read external files","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.120216Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:fb3363d90b6796225b4ae403aebb98a445016fa01e38a96f78c5b2ea57355a7b","observation_id":"c33b8571-253d-48c2-b508-1cc9a45945fa","resolution":{"observed_at":"2026-08-03T11:28:14.120216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.204114Z","title":"No markdown, no prose","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.204114Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:4f9e80005b5f2b0806c28e485dc0ff0f6d829e510a2b766c15db50ca06fa1e1b","observation_id":"270918c6-575f-44ae-8fd8-37821f51ff5f","resolution":{"observed_at":"2026-08-03T11:28:14.204114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.318189Z","title":"Decimal values are allowed","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.318189Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:d577293d1d972a51a2a9ee781d505cf68d5e51118e5d9c7ba74f7a4fde60ac20","observation_id":"455ef525-5121-4acf-af1f-9067a4e727ee","resolution":{"observed_at":"2026-08-03T11:28:14.318189Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.432489Z","title":"Author et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.432489Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:67a33445b14f4144420abb0ffea61f7345801a6edc30e48ff7605b52752a9be1","observation_id":"75b8169c-39fc-47d8-9a59-927b7fe8f234","resolution":{"observed_at":"2026-08-03T11:28:14.432489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.561618Z","title":"Your task is to compare the predicted description with the correct description and determine its level of detail, considering both completeness and specificity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.561618Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:af658aa71246eb4e791e8ee083db78ed0768fdc2091105b04bbc69b4c417a725","observation_id":"88fa096b-4eff-451b-8ff8-3378a8b5845e","resolution":{"observed_at":"2026-08-03T11:28:14.561618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.635010Z","title":"Your task is to compare the predicted description with the correct description and determine if the generated response aligns with the overall context of the video content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.635010Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:e4eacf0ba6e874a664498c44387cc1539ebe5ddad26ad0776f44e957ed391bea","observation_id":"add000b2-9537-457c-83dc-71124a73403d","resolution":{"observed_at":"2026-08-03T11:28:14.635010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.719954Z","title":"Your task is to compare the predicted description with the correct description and determine if they correctly reflect the temporal sequence of events in the video content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.719954Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:6a3479bd9eac7a94a83989e846a816509cbbefe7d2a8a36fd99ab91285dea02e","observation_id":"24c4281c-0918-4be7-b0ec-94188875017e","resolution":{"observed_at":"2026-08-03T11:28:14.719954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:28:14.840283Z","title":"You will be given two very similar questions, a common correct description and predicted descriptions for the two questions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework","version":4},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-03T11:28:14.840283Z"},"links":{"citing_paper":"/paper/2601.06550"},"observation_digest":"sha256:d494530fa846db02e681c1301766d4e84b4eb7fbac3d6b3a45143c1bd50fe4aa","observation_id":"fe80128f-4c58-4ab9-a746-c7dcef81e240","resolution":{"observed_at":"2026-08-03T11:28:14.840283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.06550","last_updated":"2026-07-22T15:20:13Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T23:57:51.136833Z","submitted_at":"2026-01-10T12:18:12Z","title":"Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":85,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 1 inbound Pith citation observation for arXiv:2601.06550."}