{"as_of":"2026-08-08T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38a03778c7fa9bbfa67aed6f9fe7387c4a426c5d098cda1f48e25ac89251e8bc","coverage":[{"denominator":255,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:10:37.391059Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01473/citation-record","integrity":"/paper/2608.01473/integrity","json":"/paper/2608.01473/citation-record.json","paper":"/paper/2608.01473"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.007161Z","title":"arXiv (Cornell University) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.007161Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:23f668ab334a33b450bfea44e602c6c154ed734c5af1528a74488e325f509b7f","observation_id":"169b94c0-8257-4844-b957-83d5fd8a99ae","resolution":{"observed_at":"2026-08-06T00:10:37.007161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.10348","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.575241Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":"217be048-103c-4873-a8b2-2dc9ddf6ae8f","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.011987Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:9202d9e6393b6732acfa2858ae60d168b54719af11ac029163926dc066e6b5ef","observation_id":"818b632f-7f21-4d6d-83c5-edc346504939","resolution":{"observed_at":"2026-08-06T00:10:40.579428Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-06T00:10:37.016076Z","title":"arXiv (Cornell University) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.016076Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d7e6da14fd49618b561bee24b47f91d666e2605808aa9923b2fa1c95f31a6cd2","observation_id":"645b7ed2-131f-452e-b4b9-395fa480e57c","resolution":{"observed_at":"2026-08-06T00:10:37.016076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.020439Z","title":"and Kondo, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.020439Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:77b0e151a20ae416c9d129183426ab44a8b70111341d330819cf92a543029fc5","observation_id":"4d5c4665-2308-4fd0-ac90-364072c3786c","resolution":{"observed_at":"2026-08-06T00:10:37.020439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.024556Z","title":"2019 , url =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.024556Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ad333edbbec89b2ed5ac389dc324e02a9ed5a8535f2c99ad3e5ff1cc0603d846","observation_id":"d131dda0-2acb-4f9c-b290-6e016169528b","resolution":{"observed_at":"2026-08-06T00:10:37.024556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jsurg.2020.07.037","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.217715Z","title":"and Sheikh, Mohd Raashid , title =","venue":null,"work_id":"a1f32f49-e75f-4759-a7ba-3dabb22fe637","year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.028865Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5808be3daec857801a9c1a6ea2fdc0f0c768cc9153374ad1ba84b4d48a5b127f","observation_id":"e1690456-0c8c-42a0-872d-598bad35c787","resolution":{"observed_at":"2026-08-06T00:10:38.222553Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.041802Z","title":"2023 IEEE International Conference on Robotics and Automation (ICRA) , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.041802Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:e39cfbfed9c2747cd811bf323be0bbc708a211665c631822d510d055c0cbfb47","observation_id":"cdd9b5fa-1bbf-4284-be9f-b3b27866a0b9","resolution":{"observed_at":"2026-08-06T00:10:37.041802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10260","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.425843Z","title":"Information Fusion , publisher =","venue":null,"work_id":"35f864aa-d5d7-4880-938c-d1ad77cae7e1","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.045151Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:e146b42e418ceb0aa09e0d8becdec862699edcfcff365cbcc0dc5b71d174aefe","observation_id":"ebae9398-023b-489b-8ac8-df1f01401c10","resolution":{"observed_at":"2026-08-06T00:10:40.430279Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.048975Z","title":"and Hasan, S.A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.048975Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:14c8e316ef3970fcbf810b97903ef1c9ecb2a5b4e19fb36903851b3b5b1b621b","observation_id":"e7a43cd6-1ee3-4e98-83b9-9363c88e2c6a","resolution":{"observed_at":"2026-08-06T00:10:37.048975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccv.2017.285","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.201445Z","title":"2017 IEEE International Conference on Computer Vision (ICCV) , publisher =","venue":null,"work_id":"28829f56-fe3a-4013-899c-f54052b5260b","year":2017},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.052753Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:abb6da73108db8642006f9bc6e70804ad4324702881ece9b4967d209a4d1bf2b","observation_id":"a41667f2-06eb-4031-84cb-db9be645c8b4","resolution":{"observed_at":"2026-08-06T00:10:38.205674Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33018102","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.190135Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , publisher =","venue":null,"work_id":"789e0005-dee6-4dde-af5d-029d755164fd","year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.056788Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:1a49e4ad4a58244fb8be9f6209f1fa700d67d68c320429e77a4460b4902cec25","observation_id":"10dd161d-8255-45e9-9fa3-28aa96c8a796","resolution":{"observed_at":"2026-08-06T00:10:38.193701Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8009.2026","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.357048Z","title":"Neural Horizons The Uncharted Future of Deep Learning , publisher =","venue":null,"work_id":"33b4651d-6148-4c2c-83f9-0ee4e10e647f","year":2026},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.060805Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:23eb63689f168d1ee839d9c13e0fe6f9bc5a0dcf29579737bb029334253c2c12","observation_id":"62db99fe-8354-4900-8048-2ae54022a412","resolution":{"observed_at":"2026-08-06T00:10:40.361768Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.063894Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.063894Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:c757414f45c07c5fb7e81379b43d0765c6b2de33bcc986b1a7c23780bc04b193","observation_id":"24e87150-4ce1-41c8-bde2-fd57f194f947","resolution":{"observed_at":"2026-08-06T00:10:37.063894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.067190Z","title":"and Zhu, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.067190Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:167a29db7bc955ba50260eb19a748dc49daee26ab2b6a58e6a6964cdb140b8da","observation_id":"79d5bf9d-1bcc-4657-8db7-7a31ee25ebad","resolution":{"observed_at":"2026-08-06T00:10:37.067190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.070388Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.070388Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:2c29907fb8d3d62f67e5db60665d5ae8d8bb38d03a99cffd411ff362f5d0a9c3","observation_id":"e9433083-955c-43e9-bd5d-cf48bf36128a","resolution":{"observed_at":"2026-08-06T00:10:37.070388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.073516Z","title":"2024 IEEE International Conference on Robotics and Automation (ICRA) , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.073516Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:447f573a64d319a65e153802b97bc53491f842ee35f85ca3f1da51a36a9d3273","observation_id":"b88db407-f431-41d4-880e-ddc9fc1eaf6c","resolution":{"observed_at":"2026-08-06T00:10:37.073516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-2992","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.173600Z","title":"Advances in Neural Information Processing Systems 37 , publisher =","venue":null,"work_id":"d2fd869f-c512-4076-aa6d-3e0f595f3dad","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.076652Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:39f296314c595fab48baac42dce96d2d20d4b306831c9ce941c90c4ad1543af0","observation_id":"8e5ad94f-b60d-4216-9701-4d61f9c9398c","resolution":{"observed_at":"2026-08-06T00:10:38.178109Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00464-019-06775-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.163307Z","title":"Surgical Endoscopy , publisher =","venue":null,"work_id":"620953b7-5840-4bad-8683-33b72044778e","year":2020},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.080604Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ab2302b8e320c05cc9a6523b3736d4f9e9e47653a4ddc9df59ffdb94e3cfbc93","observation_id":"6786700e-a32d-4601-9b88-c28d032c95a9","resolution":{"observed_at":"2026-08-06T00:10:38.166573Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.084322Z","title":"Science China Information Sciences , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.084322Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:a5f65127934c5038c37288d7b3e5f4fedf2a27b6c38bfe89efb7225847472fec","observation_id":"a4e6196d-f1b3-431a-9116-9647c35345fe","resolution":{"observed_at":"2026-08-06T00:10:37.084322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.088596Z","title":"Proceedings of the 1st International Conference on Data Science and Engineering , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.088596Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b11642428884aeda0d32baec0fba33f2b225c3ca8cc144487c70b600d3ca9093","observation_id":"b392f1ab-2400-4678-9b0d-7d0ef5aabdc4","resolution":{"observed_at":"2026-08-06T00:10:37.088596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.092925Z","title":"2023 IEEE International Conference on Medical Artificial Intelligence (MedAI) , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.092925Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d4442424b5fc766b622e8c1c54834ede931a4c7456885a5128f9ecbba34fbcb4","observation_id":"8780350b-b65a-4166-8627-b64db77324ed","resolution":{"observed_at":"2026-08-06T00:10:37.092925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.097082Z","title":"and Ligero, Marta and Sainath, Srividhya and Ghaffari Laleh, Narmin and El Nahhas, Omar S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.097082Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6352002e4537bfd211b10458e3b36ee30b73024edd99744ceddd226903f52408","observation_id":"249d418f-3060-4769-bcf7-f1e44ed01fb5","resolution":{"observed_at":"2026-08-06T00:10:37.097082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-024-01127-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.141354Z","title":"npj Digital Medicine , publisher =","venue":null,"work_id":"6ebbbe4d-6b73-43fb-8ff3-d73b947c29db","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.101083Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:84bbecf6103770fe8916f2cb20f033042480f6a12089bdc677795e2c56721cfd","observation_id":"6475d2a4-f927-4a08-8be7-34566848a4bf","resolution":{"observed_at":"2026-08-06T00:10:38.145158Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.104751Z","title":"and Garrido-Merchan, E.C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.104751Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:4382a1bf15cb6c1835c1d1c91d1ebcddc0f645e1ee8d996dc7e4611b9f23f9e0","observation_id":"3b759ae5-33c0-4600-9109-e46e1288f1d9","resolution":{"observed_at":"2026-08-06T00:10:37.104751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.00640","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:40.045388Z","title":"2018 IEEE/CVF Conference on Computer Vision and Pattern Recognition , publisher =","venue":null,"work_id":"b286037a-f9a1-497f-8563-ce5650214816","year":2018},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.108563Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:51ce30cb7dec813989b9ff47dcc37d8a6a768e49559d5b27134379d61400ad03","observation_id":"0909fd58-12a7-4e49-8387-c44b915d59b3","resolution":{"observed_at":"2026-08-06T00:10:40.049998Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.112275Z","title":"and Xu, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.112275Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:52a5b2d7543b0c5dd24c894052e3f9c9776c0f7846a53ce95855147145d77a5d","observation_id":"7c227ef3-51d6-4949-8812-3ef48632f7db","resolution":{"observed_at":"2026-08-06T00:10:37.112275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.116206Z","title":"and Nie, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.116206Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b73a473d5db221298a2394efb3b63ea659ea97536ec87431f5490862187723a0","observation_id":"0b57c8fc-6a1d-4acd-bfd5-5f1624d3727c","resolution":{"observed_at":"2026-08-06T00:10:37.116206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.120263Z","title":"and Cheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.120263Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:764d813a5482acf0e73243d19b6fcaa11f87e08cc0e4573d1626b6cec543d070","observation_id":"15d44eea-81f3-4c05-a2fb-4a8c96f9c23d","resolution":{"observed_at":"2026-08-06T00:10:37.120263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.124255Z","title":"and Shen, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.124255Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:36927ba390b4225d41e0167b9e0174d4f46c6915d128a90a083025c138a1f1b8","observation_id":"d4d15a73-df52-4c78-a89a-5731364459b9","resolution":{"observed_at":"2026-08-06T00:10:37.124255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.132010Z","title":"and Li, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.132010Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d782c1f1823c4df4f9e517f53a8ed18ed7aee78120eab6bcf0ef1be7685e9af9","observation_id":"0e493f17-cb1a-4c68-93a6-445701fd70d3","resolution":{"observed_at":"2026-08-06T00:10:37.132010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.135905Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.135905Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:11173d38d48e0b3037e64b62efdbf6c0e67a9cab3f7fd3837bdd708bc3c88521","observation_id":"79473409-e34f-4723-bf81-e92e87008b9c","resolution":{"observed_at":"2026-08-06T00:10:37.135905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.139891Z","title":"and Jeong, C.W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.139891Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:562f8e1b75d0df9c18fc13b249a76c3a4101016cfe9383be1e9154b39a68385e","observation_id":"e7073911-2d6c-44b9-ae28-7938a5f4d34b","resolution":{"observed_at":"2026-08-06T00:10:37.139891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.143758Z","title":"and Hussain, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.143758Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ddc33bce4af8bbcd5243eb7f3080b10de4f121be203d1cd7fd3039cc525556dc","observation_id":"99d5f515-780e-4bb1-9cf1-fb1e8940ca62","resolution":{"observed_at":"2026-08-06T00:10:37.143758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.147206Z","title":"ACM Computing Surveys , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.147206Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:c3ff048c148ede845e4e159753cce54685157e4f0a4451dffd2f0c66c63575d2","observation_id":"041438f5-1ce6-4867-8d5b-d10b7ea66171","resolution":{"observed_at":"2026-08-06T00:10:37.147206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.151047Z","title":", title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.151047Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b39378eca926e18e611527f36a3fc586644e04a4221beb754e7aea25ccf87db5","observation_id":"bbbf7f98-699e-42de-ab5c-a2d2fd5aca96","resolution":{"observed_at":"2026-08-06T00:10:37.151047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.157463Z","title":"Advances in Neural Information Processing Systems 36 , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.157463Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:526a0a93a30effda5d3fd743f9569a5197ce7c605f18afe75f03d2c15e585afe","observation_id":"561409ff-0307-4487-9dd2-f08e38e97e13","resolution":{"observed_at":"2026-08-06T00:10:37.157463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.160801Z","title":"and Li, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.160801Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0afcc06e30d7d10e97050be8ab12da77519b0a530402e2a7f4a04985caf4f1d8","observation_id":"b2715f4a-bac2-48a8-8819-45cdfa5c42c7","resolution":{"observed_at":"2026-08-06T00:10:37.160801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.163895Z","title":"and Skinner, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.163895Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:9753a63c44c1d81c8212556c0d86687ffcf4ec0146dba2f1a230e785fc91f87d","observation_id":"73608816-febe-406a-8ad7-9e038ca2a9da","resolution":{"observed_at":"2026-08-06T00:10:37.163895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.167177Z","title":"2019 , url =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.167177Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:a6f528e0131546f4192025af14bb603fcec10544ab0ac18cbaef65bf48958c66","observation_id":"0ec23f80-b56f-48aa-92ab-8d1fe83f20e3","resolution":{"observed_at":"2026-08-06T00:10:37.167177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.171081Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.171081Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:e9036db13455ab72ea615a84c7b0513f02ea28e30734a86e8878a8c2b2c0ce3f","observation_id":"c1a975c1-3278-42b0-ab1a-39e54b085647","resolution":{"observed_at":"2026-08-06T00:10:37.171081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73033-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":"Computer Vision -- ECCV 2024 , series =","venue":"Lecture notes in computer science","work_id":"093b0779-2a38-4712-8009-7e2b0ad82590","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.174850Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5e91e5ca5e504edc81638e1a28b6d1d7f4ba15f9d5be749f9626d9133c184cf0","observation_id":"1897ba11-9a1c-4950-b115-064012f73b3a","resolution":{"observed_at":"2026-08-06T00:10:38.118488Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.178354Z","title":"2026 , doi =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.178354Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:aa55bb6f76865a3b8fbe912feaa656ec9baa30662ce07988f428c8271a5d87ae","observation_id":"e805b9eb-8abc-4cd8-b362-32baf6036538","resolution":{"observed_at":"2026-08-06T00:10:37.178354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.182354Z","title":"and Zhu, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.182354Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:34c852b11d297f6da1da4689be3e8dd4f0ddbf55c5503deb9450d6f49cc61b4d","observation_id":"3ee758be-2a1b-4677-ac4a-c3682ea237a5","resolution":{"observed_at":"2026-08-06T00:10:37.182354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.188978Z","title":"Advances in Neural Information Processing Systems 36 , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.188978Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6e6bc7bee5b27c7b6bf909c45d7a8d707188d907a88985afb9efc6918fd92139","observation_id":"ef8d1fa1-9574-4551-a1ae-e7e01562171c","resolution":{"observed_at":"2026-08-06T00:10:37.188978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.192428Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.192428Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:4b0b7d62caaffc6caeb7a71bdbe2d00005edac8887fecd6337649bdf4bef0d8e","observation_id":"a2df8324-642b-4b17-8a42-3bed19b472f2","resolution":{"observed_at":"2026-08-06T00:10:37.192428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.195549Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.195549Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:68525206dfcbdf5989dc01a590653301965bbabb8a5ec469916f1d11241db268","observation_id":"60743eb9-c5c3-405a-a5fa-022d1b46c06b","resolution":{"observed_at":"2026-08-06T00:10:37.195549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30118","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.692000Z","title":"IEEE Transactions on Biomedical Engineering , publisher =","venue":null,"work_id":"f97ae8cd-a863-445d-bcc0-200a505e2e17","year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.199404Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:1b54f98ed24273670777650d1cd5cf56e1fb8c446aebf6030b3d9ff4560e81d4","observation_id":"ca2a4523-8caa-42a7-9b6d-c2bce2374feb","resolution":{"observed_at":"2026-08-06T00:10:39.696544Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.202943Z","title":"and Alapatt, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.202943Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f4e8008ef65fb047ef28c6779f7cb15af9e7ca31ce39fa4bfb5d735885d8b0bf","observation_id":"972364cf-ef17-4b68-9c09-4f42db36d23c","resolution":{"observed_at":"2026-08-06T00:10:37.202943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10343","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.611266Z","title":"Medical Image Analysis , publisher =","venue":null,"work_id":"2bfa3df2-876a-4cfe-8dc2-0b6c62979dbc","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.206431Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:fdac7b3df206b9c5002bc0194e324e9b32a8b2df925258b4b6b0e24536162dc2","observation_id":"ce7a8f2a-a98d-4f80-8e79-1ad10fe539b8","resolution":{"observed_at":"2026-08-06T00:10:39.615590Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.210040Z","title":"and Darcet, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.210040Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:c6029e495906693533428e16ef63fa94a7137dae6b4cac75eb61358357b7092a","observation_id":"f85681d2-3e04-468a-aad5-be6225ec77c7","resolution":{"observed_at":"2026-08-06T00:10:37.210040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.213346Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.213346Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:03b0ca1e1d88659efad778e865f87002a347dc42a95c7fe31a398c1e4aad720c","observation_id":"8e56816b-c0e0-47b9-9291-03a74c6227a6","resolution":{"observed_at":"2026-08-06T00:10:37.213346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.216566Z","title":"2024 International Joint Conference on Neural Networks (IJCNN) , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.216566Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b6d3bde59f0c6103da6195b5ae0635d93b5ad7fb6b014be2dc5f1c2655e3d0ab","observation_id":"8f2d3901-401a-4588-b773-ca8670765461","resolution":{"observed_at":"2026-08-06T00:10:37.216566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.219674Z","title":"and Kim, J.W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.219674Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ba81147240ae6b52274ae71536dd2e76563309df854f0cbeaaabae4d8d51f84e","observation_id":"7a160bb8-ce64-4e62-899a-4acdf0947fb4","resolution":{"observed_at":"2026-08-06T00:10:37.219674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.222881Z","title":"and Tu, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.222881Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:c59f39695c18d821fc5c34340420e9aab3b165dc955ccf6192520a52821dad8b","observation_id":"016075e4-6b1b-4e06-9df6-1e2787dac922","resolution":{"observed_at":"2026-08-06T00:10:37.222881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.226047Z","title":"and Cho, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.226047Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:4fa454ee343ece8c16951949da9c8a4f39f351ccbfd9161a480ba810091c79be","observation_id":"3d12a3d2-cac7-48c7-950d-385ae7db94e8","resolution":{"observed_at":"2026-08-06T00:10:37.226047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.229835Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.229835Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:1aeee1590b8d0542a359e35655f594cf47f1c7667768a9badf705d89e3e55489","observation_id":"3bbf68c2-ba96-4146-a01c-b6f1df43699e","resolution":{"observed_at":"2026-08-06T00:10:37.229835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.233750Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.233750Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:16c7d93593135437f2142e0eb76d9fa51112c5d71937ec073fbf73f9c8f5d01a","observation_id":"8910312e-4244-450b-b23e-83d9a9c5436e","resolution":{"observed_at":"2026-08-06T00:10:37.233750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-021-98390-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.085442Z","title":", title =","venue":null,"work_id":"5025e0df-00e7-41b7-97c6-f44d65735f6a","year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.237811Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3f6d8ae6ec869deae5f3ff1af441c989cd00c8a231adf90d2a981dd1651883e2","observation_id":"8e7c4974-b259-42a8-a8b8-88f787ad1945","resolution":{"observed_at":"2026-08-06T00:10:38.089644Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.240989Z","title":"and Kida, T","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.240989Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:433d136f0ef2242ad011d5a0d2ca832b7680ceee12fd6810a546dc60ab10a320","observation_id":"323e0091-83d4-47d6-a07c-99ca8c26aee0","resolution":{"observed_at":"2026-08-06T00:10:37.240989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10324","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.473817Z","title":"and Liu, Jiangfeng and Wang, Jing and Wang, Binglu and Yang, Juntao , title =","venue":null,"work_id":"a65707ab-64b8-41a4-a59c-ec0688794ec8","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.244985Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:da353c2391a9607bb148a341a607acebfbb90a3c6c2cfef6ed22e761e29bfb65","observation_id":"b36706cd-19dc-4c99-aa58-be0f44936978","resolution":{"observed_at":"2026-08-06T00:10:39.478510Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.248263Z","title":"Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing , publisher =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.248263Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6ece02a9a611006c65786c65543e7aa7f2642d672d761475708d855c58f17d23","observation_id":"e1918b88-a00c-4491-bd5a-f1c4c7360c36","resolution":{"observed_at":"2026-08-06T00:10:37.248263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.bionlp-1.35","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.068047Z","title":"and Mullappilly, Sahal Shaji and Cholakkal, Hisham and Anwer, Rao Muhammad and Khan, Salman and Laaksonen, Jorma and Khan, Fahad , title =","venue":null,"work_id":"d8e75648-c10a-4a16-be24-3a7598fc2ae8","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.251979Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ceffdd292fa1094eb7256c569bcedd3fb0621175f0680e6e756bae6f500da82e","observation_id":"05ec1f25-679f-4516-9a14-98f1bc0d2230","resolution":{"observed_at":"2026-08-06T00:10:38.072150Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.255415Z","title":"Proceedings of the 38th International Conference on Machine Learning , publisher =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.255415Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:40a386f2fe6bb664d35c1825e6cc73211835cefd8650325c709a4898db814c76","observation_id":"4ed55af9-5c1c-494e-bdd0-550b5c900279","resolution":{"observed_at":"2026-08-06T00:10:37.255415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.259344Z","title":"and Martin, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.259344Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:1afbc36ff08948f0562ec49e00f7adb96cd0ab0b7ab9ab63e9b0dc8e5b0e787b","observation_id":"c79f9e90-1244-48bb-87e2-36859abb28aa","resolution":{"observed_at":"2026-08-06T00:10:37.259344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.263368Z","title":"and Azizi, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.263368Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:472eb67729d18c2c9f7182d5da10bb8f1fef1a355efd6cc26b2eea87d87a9b8e","observation_id":"d4a69d45-d3eb-4831-a447-bd445e4674cb","resolution":{"observed_at":"2026-08-06T00:10:37.263368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.267059Z","title":"and Shehata, Sherif and Mutter, Didier and Marescaux, Jacques and de Mathelin, Michel and Padoy, Nicolas , title =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.267059Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3bcece2a6c75c6afec75c948db7db5625bdac5313dcf0e5840b3695fa989c603","observation_id":"41cac4d7-1a4b-4961-8b05-27ef768110cd","resolution":{"observed_at":"2026-08-06T00:10:37.267059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-84300-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":"From Human Attention to Computational Attention , publisher =","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","work_id":"35f9ff32-139f-4ff1-a6f1-dafffa263d03","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.270806Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5ee83290fc7cd055de6d5655dd5863d37bcc075d39a6dc8c3be649a0a40acc34","observation_id":"ec0c9978-a960-4a0e-9ba2-58b69604726c","resolution":{"observed_at":"2026-08-06T00:10:38.061715Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10277","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:39.024198Z","title":null,"venue":null,"work_id":"cb0dc2e7-ce4f-477a-838a-c7b369cbd3f3","year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.274697Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f64565897b426114974b25d52eb65614d938f1f31da498e8558c57b61cc0cd1b","observation_id":"bddf6200-1ab5-420b-b3bb-748dd8562d54","resolution":{"observed_at":"2026-08-06T00:10:39.308103Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.278561Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.278561Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0f7b516ec47d65eb10449dd589dbf7c5fc294c72803c546f71e40616b038da18","observation_id":"a218bb70-1f25-4000-94e9-5f327e68761c","resolution":{"observed_at":"2026-08-06T00:10:37.278561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.281695Z","title":"2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.281695Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3cae516a9ae005aa05428268fc3915b24aac86561b89f41caf71a81255709a11","observation_id":"d60d24f7-f34c-4418-8da8-1bb23c780e6b","resolution":{"observed_at":"2026-08-06T00:10:37.281695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.284819Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.284819Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b5b12d94e97b0a6a2b99ac61819f3efea35f454d9aa41fcae8cf39cdcc93ec90","observation_id":"a94551c7-314b-43c6-8354-066c6d043c0f","resolution":{"observed_at":"2026-08-06T00:10:37.284819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.288108Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.288108Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:711f59b5ea6269fb7d2890992b2676220f895729bfc308af472e2e571aa11291","observation_id":"824ba28d-7ef0-40ab-bae8-d7c84b9498a8","resolution":{"observed_at":"2026-08-06T00:10:37.288108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.291563Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.291563Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d77f041038fc51b9ebad1a5320d977d02f18fb770e03a16ed328da18bc9fe18d","observation_id":"84da6114-17da-4cc6-960a-3af4773806a9","resolution":{"observed_at":"2026-08-06T00:10:37.291563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.295552Z","title":"and Duan, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.295552Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:9bf80ff3d91c1ceb28b09e3c707a164f202909f5dbbfe4d78a186834e358578d","observation_id":"f4fac706-4cb2-40db-a9af-2d024ca65a97","resolution":{"observed_at":"2026-08-06T00:10:37.295552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44172-024-00271-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.048074Z","title":"Communications Engineering , publisher =","venue":null,"work_id":"7e91af53-6a62-465b-9add-2eff91b383d2","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.298998Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f246a7e793e3366d7590cebbee7adcff54ccd184a60fd450fbd1fa0469a3bc62","observation_id":"fb4aafa9-40ea-4c4f-89ff-5c598b5b40dd","resolution":{"observed_at":"2026-08-06T00:10:38.051733Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.302298Z","title":"and Shu, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.302298Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5ff5a334e86585beb56f60f4602b7ef1f711f82b380e54007dd9412dc278cee9","observation_id":"e06a8199-597e-47a4-addc-44d74f7b047c","resolution":{"observed_at":"2026-08-06T00:10:37.302298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.306570Z","title":"and Yu, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.306570Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3f1d538c61d88ce36567b0590416dee56b11013e4f0bea6bc437ce6a334a5cab","observation_id":"355177be-5f96-42d0-96bd-749cb290939b","resolution":{"observed_at":"2026-08-06T00:10:37.306570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.310403Z","title":"and Yu, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.310403Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:ee7405d395bd8b2fa93becee6af6620699be0c94bc1479ecf20d15420451575d","observation_id":"81b7b4d1-9600-4d52-ae99-d5377e08e657","resolution":{"observed_at":"2026-08-06T00:10:37.310403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28173","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.865776Z","title":"IEEE Transactions on Neural Networks and Learning Systems , publisher =","venue":null,"work_id":"ca213af7-3c3a-4363-8d89-7263c592aebd","year":2018},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.313819Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:6333183fcfd973d00153e64f00b0051a5c35323c2678e94e3bc8f305d2ade51f","observation_id":"5f10686e-1811-44ea-9a10-3bbf9b7fd5de","resolution":{"observed_at":"2026-08-06T00:10:38.871658Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11548-024-03141-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.037497Z","title":"and Navab, Nassir and Srivastav, Vinkle and Padoy, Nicolas , title =","venue":null,"work_id":"031e3e86-ae3c-4018-8ea7-15a647da6ac3","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.317713Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:48131142b5b3597dbf587f66e8e8bc7719da5e47bdce8df7175716d67393c9f5","observation_id":"55b8687a-c832-47cf-9c93-2405e2a6a3df","resolution":{"observed_at":"2026-08-06T00:10:38.040915Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-3907","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.026045Z","title":"Advances in Neural Information Processing Systems 37 , publisher =","venue":null,"work_id":"c85198cc-963e-4d94-930b-d85f572a5a42","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.322460Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0c6313e151bec2a9745f068ee41aeb489cce52c124a59e050eaeaf39243b37f4","observation_id":"d07c83fc-df4b-4e14-b44d-e4455686833a","resolution":{"observed_at":"2026-08-06T00:10:38.030515Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.326739Z","title":"Lecture Notes in Computer Science , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.326739Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:79fb2a1bb45d48e8c7202b7064e3712d0a5e07a7b0b85745d5df1192cfbd79cc","observation_id":"3c13843e-2329-43b3-9b31-d934dabaf23c","resolution":{"observed_at":"2026-08-06T00:10:37.326739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.330695Z","title":"and Marescaux, Jacques and Mascagni, Pietro and Navab, Nassir and Padoy, Nicolas , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.330695Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:da62ff8caf1ec557a95e7e4d5078c8b23c5e8d85381e728566a33c036063de24","observation_id":"2aa87f89-5952-4c06-a660-c8aee7a50317","resolution":{"observed_at":"2026-08-06T00:10:37.330695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.334040Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.334040Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:0d5167c0f87f83c0be917ae0de196b132222355b09bd6f62519f36b1e6fbcfbb","observation_id":"86a1b598-68e4-444e-9439-42b0c54fca90","resolution":{"observed_at":"2026-08-06T00:10:37.334040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s42492-024-00160-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.008953Z","title":"Visual Computing for Industry, Biomedicine, and Art , publisher =","venue":null,"work_id":"a444ee10-f4d9-4b8d-9601-1219be44edab","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.337227Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5cb46b5f24a2eb766992c12af376206cfe7993325f3041e8c60fbfb9a85307db","observation_id":"df3d41a1-47ec-499d-b907-a5f160f9aaff","resolution":{"observed_at":"2026-08-06T00:10:38.013076Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.341216Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.341216Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:33cac0d88483d55b45e9d0c908fbdad2e6b2ce8d95fe56ff7d2474ecd28eafcf","observation_id":"14afca63-9d05-4b0d-ac58-89a0c046d6c0","resolution":{"observed_at":"2026-08-06T00:10:37.341216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.344873Z","title":"and Bai, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.344873Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:b3205dc0a339d172080c0c6d5be02d6cdbed5793f3aa096460998617b3a65bae","observation_id":"51ae2646-91a5-4383-b01f-adc54196f809","resolution":{"observed_at":"2026-08-06T00:10:37.344873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.636","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.997961Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , publisher =","venue":null,"work_id":"4e3c5183-4814-4f26-9fa9-df94d9042298","year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.348456Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3a1e39a753bf6c135e4a27e808772a0ead884df42e7bf440fa47db94923080b7","observation_id":"09b521a5-3a46-4d21-816a-35e836b43014","resolution":{"observed_at":"2026-08-06T00:10:38.001750Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.351840Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.351840Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:c66b1cd59f4ef752804ce4e6f354ba782b44405694cdf5750d4ca4eef9cf4161","observation_id":"3b759929-a8a7-4d4e-875f-dcb544e37da2","resolution":{"observed_at":"2026-08-06T00:10:37.351840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.63317/4jh5knz54ake","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.986347Z","title":"Proceedings of the Language Resources and Evaluation Conference , publisher =","venue":null,"work_id":"3a626c21-73f9-4d37-8047-dedabc44e2c2","year":2024},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.355018Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:752568b03089415b71a11d33e372b0daddf67f11efcf279b816af4c745f6776a","observation_id":"d0aaa78f-4232-4df0-836f-c49c4424bd38","resolution":{"observed_at":"2026-08-06T00:10:37.991236Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.358458Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.358458Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:67734e27c2030c556b0d3eec37b1eac36faeb98ac21a0a425697274c55e2dde3","observation_id":"364223b7-c1a2-4e92-95cf-04ec42277613","resolution":{"observed_at":"2026-08-06T00:10:37.358458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.362667Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.362667Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:96558df2693a0a5d74061099ae844eae017b5e6eeea3d95106987dfb1d00c851","observation_id":"4edcc406-502c-422f-aedd-a066db0cfe99","resolution":{"observed_at":"2026-08-06T00:10:37.362667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.366271Z","title":"Proceedings of Machine learning and systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.366271Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5a3c7af0d60f9c230619f9c279bc5045fef8bca67dd3c76927d7c252bdbe2fd4","observation_id":"d6fbb573-58c4-4cad-9828-cbc1e51ab474","resolution":{"observed_at":"2026-08-06T00:10:37.366271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.369912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.369912Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:4bd37d210e7edfdb227d7675cddc3f7a7b4581494eb68f8336564fba99e48d08","observation_id":"81f3e913-3ffb-4566-a378-4ae6244aaa7a","resolution":{"observed_at":"2026-08-06T00:10:37.369912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-06T00:10:37.373216Z","title":"arXiv preprint arXiv:2508.10104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.373216Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:d697186de668774e92027d16cd5b944098b65c0fa1bf91d872023400b47b930c","observation_id":"170bbe89-5d06-4c80-8f3b-82bee741376b","resolution":{"observed_at":"2026-08-06T00:10:37.373216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.12477","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:38.624078Z","title":"arXiv preprint arXiv:2501.12477 , year=","venue":null,"work_id":"6b9c415b-e94c-4435-9804-24c7f4e35cf7","year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.376803Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f26a570272e7df528836e125aac5aebe536cf865b86d637746ce0fd429e5bb8d","observation_id":"b63ac69d-817d-42f1-8911-1f3341c61105","resolution":{"observed_at":"2026-08-06T00:10:38.630135Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.380483Z","title":"International Conference on Medical Image Computing and Computer-Assisted Intervention , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.380483Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:3e73ae849fe774163f2dd8a62f4f0db63a0e2b8c89757b1243fb8fff679261fe","observation_id":"14e85782-b8a9-405d-8f1b-38530456f3ac","resolution":{"observed_at":"2026-08-06T00:10:37.380483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-06T00:10:37.384400Z","title":"arXiv preprint arXiv:2403.12945 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.384400Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:f44ae04b44c3c80a4052b5a91e638424f6ac6a4c03b23fd73a85b1a49b6cdddf","observation_id":"2a153a74-f97f-4955-8f55-c249c3f49b55","resolution":{"observed_at":"2026-08-06T00:10:37.384400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.388022Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.388022Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:5f17895981a2031162894284e4b69d14d360da54af4b87ae19ca69a69e00c624","observation_id":"b4f03e3a-fb92-4f16-bcb2-caa5685d3d57","resolution":{"observed_at":"2026-08-06T00:10:37.388022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:10:37.391059Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-06T00:10:37.391059Z"},"links":{"citing_paper":"/paper/2608.01473"},"observation_digest":"sha256:20b4f1f7eac6381a809d8c39a83f2ba19705bed90c8d573f242b1ef0bbfe0e71","observation_id":"e3e108b5-2533-4478-986c-8339b117f712","resolution":{"observed_at":"2026-08-06T00:10:37.391059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01473","last_updated":"2026-08-02T20:09:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T23:26:37.446330Z","submitted_at":"2026-08-02T20:09:45Z","title":"Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":74,"verified_exact":19,"verified_fuzzy":0},"total_outbound_references":255},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 255 outbound references and 0 inbound Pith citation observations for arXiv:2608.01473."}