{"as_of":"2026-08-11T08:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eecf72e2cd27f8458b0d2911f0624da3000c941f42ac7c8d63ac759a6a8ea57f","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:17:48.814483Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.06708/citation-record","integrity":"/paper/2605.06708/integrity","json":"/paper/2605.06708/citation-record.json","paper":"/paper/2605.06708"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Divprune: Diversity-based visual token pruning for large multimodal models","venue":null,"work_id":"16dfaa36-8c9d-4937-b77c-b835496004d3","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:1d4e91cb41c4cdfc41e8ca599e647976d9518d3e13cc77636f8e4d3f712b2de1","observation_id":"df9b079c-94bb-42f4-83ba-b1783a23246c","resolution":{"observed_at":"2026-05-14T16:57:29.848911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"ea7c36e8-7fe6-47e9-8363-0e2fac71850f","year":2024},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:8ee004e9549cbefe8f5595712b655fa38d5fd98400085254f97bd423d3b9af9c","observation_id":"95b42e65-6a33-4a86-ac0b-a34ac9d1fc8d","resolution":{"observed_at":"2026-05-14T16:57:29.798534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14782","last_updated":"2026-05-31T00:04:33Z","snapshot_observed_at":"2026-08-07T18:21:12.072228Z","submitted_at":"2024-05-23T16:50:49Z","title":"Lessons from the Trenches on Reproducible Evaluation of Language Models","version":3},"cited_work":{"arxiv_id":"2405.14782","doi":"10.48550/arxiv.2405.14782","metadata_source":"pith","pith_arxiv_id":"2405.14782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lessons from the Trenches on Reproducible Evaluation of Language Models","venue":"cs.CL","work_id":"47b597a2-a355-4305-b1e4-80666b394ccd","year":2024},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2405.14782","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:f860ad4e1c7aac38a9ebd945a18363f3191dac1ccce432b9153ebed160c06008","observation_id":"d9119aaa-2ba0-47a0-9f29-aa36988605a4","resolution":{"observed_at":"2026-05-16T18:44:50.211576Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:45.557591+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:45.557591+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PLOT: prompt learning with optimal transport for vision-language models","venue":null,"work_id":"c2a01f3f-ab97-4e94-b90e-75a438f21688","year":2023},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:7bd88f3ebe7185fb33dfbcc44466ad7f0840a82248a2bdb03d123bae554b3877","observation_id":"05d11016-9c2a-4566-85b4-5b3aefdfcad1","resolution":{"observed_at":"2026-05-14T16:57:29.776277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Information bottleneck revisited: Posterior probability perspective with optimal transport","venue":null,"work_id":"7f7d18bc-f467-4c1b-a310-1c3739db9c39","year":2023},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:3e0fb0bd35b437862082335be819d07a4a32bf593bbf9930eb3e6c0ea673d5ec","observation_id":"344e34ab-fcd7-4402-b6e8-a6138fbeb23f","resolution":{"observed_at":"2026-05-14T16:57:29.768065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph optimal transport for cross-domain alignment","venue":null,"work_id":"f26ad590-ba70-4e42-8299-5e1450f6ab50","year":2020},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:2faebb6ce0551d61e76f1445e8461973c0ed0855fb89ad7034a1e5934df9fb22","observation_id":"01564238-4420-4dcb-994b-c4b448acbc92","resolution":{"observed_at":"2026-05-14T16:57:29.815865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22730","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imgcot: Compressing long chain of thought into compact visual tokens for efficient reasoning of large language model.CoRR, abs/2601.22730","venue":null,"work_id":"9b496d57-59c7-479b-ad6c-ea93dd0975eb","year":2026},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:549921a795c1702bbaf2164e159a0481ae66a61bdf893a03ebd5562a43dbdda4","observation_id":"0743dca3-83c9-460b-89ef-71a7b804d955","resolution":{"observed_at":"2026-05-11T04:30:57.703703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20205","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OTPrune: Distribution-aligned visual token pruning via optimal transport","venue":null,"work_id":"7b8744a9-1ccb-4c9a-958a-18cb4d75e0ed","year":2026},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:1433ab370bb7bb4363207338c53cb1c88ad09fe6ef9b4271d40260fa2794497e","observation_id":"4fb768b1-ad2d-47c1-95d1-3863ca327beb","resolution":{"observed_at":"2026-05-11T04:30:57.444928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.262420Z","title":"Glyph: Scaling context windows via visual-text compres- sion","venue":null,"work_id":"fd554aed-9fbc-48cb-bbcd-f2beff67c3d3","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:d58cdae93360080689f640524f8ff965e479d3f67cb9d2ef1d7d63e8d9f453da","observation_id":"e72dab2a-1082-428f-b73a-7a7bdbc06242","resolution":{"observed_at":"2026-05-11T04:30:57.545322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"efd547e5-36ff-43d1-9c54-4ea5b2b1bbda","year":2019},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:614f49faf9b4ab416700ee58228d4520f4be806fd29167766ed20f5eb0f2c200","observation_id":"e80dfc19-8b58-4d08-b752-05013106c8b6","resolution":{"observed_at":"2026-05-14T16:57:29.833845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smith, and Matt Gardner","venue":null,"work_id":"7f9a806e-80a7-4157-a0c8-1e651703179b","year":2021},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:88a62b888c571c7c591ea1c60f0166a5fbd3b10a4513b826516ccb84f8f06039","observation_id":"fafe2dc9-ac70-4d12-a7b4-1fdd5b22c27c","resolution":{"observed_at":"2026-05-14T16:57:29.840460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"2ef1aff4-de87-44a4-b4f3-70bd66c20d54","year":2021},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:13357f129586c87fb0f270c3b28feab043fe0ff05d608c597c351a8f659960fc","observation_id":"0bdccfd5-db0a-4911-a01d-083523589d7a","resolution":{"observed_at":"2026-05-14T16:57:29.829872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DROP: A reading comprehension benchmark requiring discrete reasoning over paragraphs","venue":null,"work_id":"a1c97cd5-eac6-4c4c-814a-9237e623d983","year":2019},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:5975cf4eeb3aeb3c69cd2a4899c7483aa2e2d0060a9918de839c23c082a8e1c6","observation_id":"66ee1516-ec3d-4d12-9e47-bc7d02360b08","resolution":{"observed_at":"2026-05-14T16:57:29.824347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.04786","doi":"10.48550/arxiv.2601.04786","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentocr: Reimagining agent history via optical self-compression","venue":"arXiv (Cornell University)","work_id":"2c3479ab-178a-4ea6-b25e-812d64d36681","year":2026},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:b9340598086871797ec95cc12f795cef6983fd05d26516beb95c72b43c7fd218","observation_id":"0bf7cf86-9ec5-456c-8464-826d9ebbb901","resolution":{"observed_at":"2026-05-11T04:30:57.476303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Teaching machines to read and comprehend","venue":null,"work_id":"fe9e24d3-8b94-4fe4-b32b-53485d906289","year":2015},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:cbad73fd470887daadc71fe52c7bbc999bb2548f29c8a9f943c5db8a08b2cd6d","observation_id":"41ec781c-be82-4cb7-b911-a69fd8a6daab","resolution":{"observed_at":"2026-05-14T16:57:29.836296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Constructing A multi-hop QA dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":"6a536301-c48b-42f4-8023-c8571dd1870d","year":2020},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:cf0797f54397bfca41f264b121cc7e5a5f8b2f14e6ced5a77a7c43fbf4833956","observation_id":"ee7c1a22-9e00-4342-b115-f7f16fd8a0ae","resolution":{"observed_at":"2026-05-14T16:57:29.857669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient attentions for long document summarization","venue":null,"work_id":"8813385a-191c-4e2c-9b3f-62f755bf00f9","year":2021},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:efc2b3afa9ed74aee375ffbaee3cf4869713d76d95f6d808ced2c7d3b0f7a870","observation_id":"d663fbc8-87a3-4a8b-9463-e4ff7679786b","resolution":{"observed_at":"2026-05-14T16:57:29.761760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.10378","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Global context compression with interleaved vision-text transformation.CoRR, abs/2601.10378","venue":null,"work_id":"cfca2a8a-34c7-4ae7-8224-4d946fa3bdf4","year":2026},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:e355218a2144b127e7ead3ef16d0979d48f6ddc371a7620c9962e9708f5b30eb","observation_id":"2312bbe3-bc51-49be-9cc1-f3d5dc296d68","resolution":{"observed_at":"2026-05-11T04:30:57.685951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"27c810ef-887a-4fe1-b31c-7d7487f622ad","year":1907},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:d20b4f4a218868916b7b6abdc352811c5f4a3e1c29cb18d1c19dde451f021037","observation_id":"f4e07107-de79-4bc1-84fc-103119f0bd56","resolution":{"observed_at":"2026-05-14T16:57:29.763897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00523","last_updated":"2019-12-04T02:50:00Z","snapshot_observed_at":"2026-07-06T08:26:07.992286Z","submitted_at":"2019-10-01T16:25:12Z","title":"BillSum: A Corpus for Automatic Summarization of US Legislation","version":2},"cited_work":{"arxiv_id":"1910.00523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.00523","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Billsum: A corpus for automatic summarization of US legislation","venue":null,"work_id":"7afa3787-dc2c-49b5-b52b-d8a13002f6a3","year":1910},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/1910.00523","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:59efaa21b89a540b4aa1e6753ab91f2736f4d69acd34ac6dc5f5f76c791754f6","observation_id":"5077780e-bf71-4f6f-99e6-f0635e9feed8","resolution":{"observed_at":"2026-05-11T04:30:57.651903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3867c21-a37d-46d4-82d0-17faf11189a5","year":2017},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:bd10165410329e25ab2b5b476f38b627d9a044f21c486cd0186211d00258e6c1","observation_id":"90ba9c33-6371-4917-9a3d-35dce7961612","resolution":{"observed_at":"2026-05-14T16:57:29.773944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.03643","last_updated":"2026-04-04T05:28:18Z","snapshot_observed_at":"2026-08-07T15:41:08.808505Z","submitted_at":"2025-12-03T10:27:27Z","title":"Optical Context Compression Is Just (Bad) Autoencoding","version":2},"cited_work":{"arxiv_id":"2512.03643","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.03643","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optical Context Compression Is Just (Bad) Autoencoding","venue":"cs.CV","work_id":"c53b9511-9e27-461c-89df-1121465af05f","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2512.03643","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:3d90a2c311c6382f6ef5d6ca0902a0e00470620b13a941b7fe124c600229fea0","observation_id":"a78dc8c5-5345-4dff-9a74-d6042468dc2f","resolution":{"observed_at":"2026-05-11T04:30:57.757121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:23:15.112427Z","title":"Text or pixels? it takes half: On the token efficiency of visual text inputs in multimodal llms.arXiv preprint arXiv:2510.18279","venue":null,"work_id":"91344dd4-fb38-40cd-98cf-5f2518cea622","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:848e94217400fc4f73b6694cfadf9a9a1855f8a1730f81d43eca6701d9977a48","observation_id":"13935e2d-019e-442c-987e-fe06a8bd8d1b","resolution":{"observed_at":"2026-05-11T04:30:57.432526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:53:47.018404Z","title":"Visual merit or linguistic crutch? A close look at deepseek-ocr.CoRR, abs/2601.03714","venue":null,"work_id":"50be5cec-4802-4e55-ae98-7134240770ba","year":2026},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:693149114e142fecb2708d7e389cc71467a86e9bdadff9d41c50cea739673ffd","observation_id":"8e3c362e-8b8d-47e7-8869-9b9b73fff21b","resolution":{"observed_at":"2026-05-11T04:30:57.506348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning","venue":null,"work_id":"77226e7e-dd64-4f1f-b613-7f8a4c0739c4","year":2020},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:c1ae9f741211c9986b5c11bae1b4e9192eee7ce35033620e88d64de450732536","observation_id":"7c06d364-6b3b-4791-8498-5d20ba3be4f1","resolution":{"observed_at":"2026-05-14T16:57:29.818596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15969","last_updated":"2024-04-18T18:48:31Z","snapshot_observed_at":"2026-07-06T17:21:42.659240Z","submitted_at":"2024-01-29T08:58:07Z","title":"Routers in Vision Mixture of Experts: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2401.15969","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.15969","snapshot_observed_at":"2026-07-01T06:55:28.737703Z","title":"arXiv preprint arXiv:2401.15969 , year=","venue":null,"work_id":"03a69065-afa9-4265-8c83-1e94233c1a91","year":2024},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2401.15969","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:bdfec3d03ccf06398e672e041c87a84a8610f0bd0eae75c32c36336f5d947e3e","observation_id":"06ea43a7-befe-47a1-9915-54ebf0d5b562","resolution":{"observed_at":"2026-05-11T04:30:57.572120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-modal alignment with optimal transport for ctc-based ASR","venue":null,"work_id":"a25e5a76-09b8-4299-aa21-875601c7bb07","year":2023},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:d798152989324d8018f9a90d5c13dd56da149d8a69f1eba96dd9695e476d1a5e","observation_id":"8b7d3f5d-6735-4c0a-8617-c9f85065493a","resolution":{"observed_at":"2026-05-14T16:57:29.851414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14213","last_updated":"2024-08-26T04:59:05Z","snapshot_observed_at":"2026-08-10T18:27:52.233583Z","submitted_at":"2024-05-23T06:17:23Z","title":"From Text to Pixel: Advancing Long-Context Understanding in MLLMs","version":2},"cited_work":{"arxiv_id":"2405.14213","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14213","snapshot_observed_at":"2026-06-30T11:44:37.993936Z","title":"Eckstein, and William Yang Wang","venue":null,"work_id":"23de43d8-7ce3-4548-8115-ed4d7e5c134b","year":2024},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2405.14213","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:ae9b2d181080c12d947ec9a3d647e2eeda604a4e40a3192360728cab6a8f8257","observation_id":"4599e2b0-48c9-43fc-a656-216372864089","resolution":{"observed_at":"2026-05-11T04:30:57.787128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.19339","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T11:34:37.640028Z","title":"Pixelworld: How far are we from perceiving everything as pixels?CoRR, abs/2501.19339","venue":null,"work_id":"fb915bc9-3231-4507-b51e-c00993496e58","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:9360585dfdddb87c3cabdfc09d486f41a1a9b9f186967bf772702771c21add23","observation_id":"cad4f7f5-2f18-45b1-99d9-292125edcc6e","resolution":{"observed_at":"2026-05-11T04:30:57.638360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maas, Raymond E","venue":null,"work_id":"a5093d4e-9117-4d80-bb34-1bf7c84e45b0","year":2011},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:ec8dfcf19c9cabf35669ed8b81e15ac423344132918884a8829c30adc815433e","observation_id":"61ff78a8-32cf-4c2f-8fd4-80fd33ee9c86","resolution":{"observed_at":"2026-05-14T16:57:29.862446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Joint wasserstein autoencoders for aligning multimodal embeddings","venue":null,"work_id":"b418f253-9db6-4a45-b9b2-a6c2e432cb1a","year":2019},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:8722829f59c59ea5fda38889c3bf931ec9307df2c263bba35c52cd30ace89b59","observation_id":"8f03ea55-1662-498b-aaed-121ad6fb1654","resolution":{"observed_at":"2026-05-14T16:57:29.881019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cohen, and Mirella Lapata","venue":null,"work_id":"d78e36e6-7f95-4e40-a229-623526e8102e","year":2018},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:af64569cfacb57e89a1eac57bbf861d8c85163939631dadc004daf6788d1bb2e","observation_id":"91f25641-c9fa-4424-b14c-c30b41e9aa17","resolution":{"observed_at":"2026-05-14T16:57:29.758377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.08972","last_updated":"2026-06-04T02:54:34Z","snapshot_observed_at":"2026-08-06T17:48:05.257674Z","submitted_at":"2025-11-12T04:29:05Z","title":"Selective Sinkhorn Routing for Improved Sparse Mixture of Experts","version":2},"cited_work":{"arxiv_id":"2511.08972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.08972","snapshot_observed_at":"2026-07-01T06:55:28.741767Z","title":"Selective sinkhorn routing for improved sparse mixture of experts","venue":"cs.LG","work_id":"8298d25a-ae00-45fe-8ae5-76e7cce8cd57","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2511.08972","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:c626f98dcdd9bce2587890dc87dc189da8b298f29a27ada089a7dcdec1910979","observation_id":"cfe23203-b1b1-448d-a71f-587807450b77","resolution":{"observed_at":"2026-06-05T02:15:30.496448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f99eb6e8-586c-458e-8d90-b47ea05ad06d","year":2022},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:30d0d99252483013e515cffde0cde760eff98687f6494605468166fb35568d7f","observation_id":"0c3be78b-4cdf-4147-b56f-64cc772965e8","resolution":{"observed_at":"2026-05-14T16:57:29.865607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Computational optimal transport.Found","venue":null,"work_id":"7944e196-9c6a-478e-8cb6-6852c0a02b57","year":2019},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:271c16d99cbdbfa1f5eb3da186cf0fb5ccc56708cd8d1c40f139835ba3327aec","observation_id":"fdccbb6a-d6df-47ce-b9c4-5bc3d4324e28","resolution":{"observed_at":"2026-05-14T16:57:29.872864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3492746e-e7f3-424c-a2c4-bbd8596b7cb3","year":2019},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:581100dc3c257e8d6f99cab69205cfe78debdf86ded02a45a86ab2b7f99880c3","observation_id":"a64d3725-58d8-4a1e-9a6b-7da165c5b5c6","resolution":{"observed_at":"2026-05-14T16:57:29.877700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robertson and Hugo Zaragoza","venue":null,"work_id":"0df1e817-5844-4451-95da-c8b8f34e6e69","year":2009},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:336a7f84d73b45e106b4c4077e424ede702dc39d63a5bf9a06950381821b7afa","observation_id":"27161d99-f925-4e56-9273-8a8da50dd394","resolution":{"observed_at":"2026-05-14T16:57:29.859864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model fusion via optimal transport.Advances in Neural Information Processing Systems, 33:22045–22055","venue":null,"work_id":"2258689e-3bf8-442e-bf53-2fefd4d8cdeb","year":2020},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:a97ebd234642af858862140c010ad2522177bb9587e124847c9d124d54071bba","observation_id":"dbdcb744-36dc-4f7b-b7d6-c5944a1e15b2","resolution":{"observed_at":"2026-05-14T16:57:29.868485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dream: A challenge data set and models for dialogue-based reading comprehension.Transactions of the Association for Computational Linguistics, 7:217–231","venue":null,"work_id":"04469cd9-ed11-41e1-9554-fe0719b0dbce","year":2019},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:11b117308db077c710ba1841af4743fad5a7ccaefa09b2eb63ab1282dba0fa85","observation_id":"b647f46d-9165-4dc0-9a4b-909e42f2b3d5","resolution":{"observed_at":"2026-05-14T16:57:29.821592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:e1df0a8b9b9f3199df222bba6ca441deefaedd2820f347e303f86f069b992b0a","observation_id":"bb12603d-5573-4318-8852-19fb6b20efb5","resolution":{"observed_at":"2026-05-11T04:30:57.425377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Musique: Multihop questions via single-hop question composition.Trans","venue":null,"work_id":"c2fef5f7-890f-4b1f-bab7-b91eaa78bafc","year":2022},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:48585b26c996c2824e6dbdc38e9d24ab288e964f31a0c60df0dd20492fd510fd","observation_id":"5fd6c085-f67d-40a1-8431-2c6b56fb8836","resolution":{"observed_at":"2026-05-14T16:57:29.779903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"0809.2553","last_updated":"2008-09-15T15:33:11Z","snapshot_observed_at":"2026-07-06T01:47:41.704596Z","submitted_at":"2008-09-15T15:33:11Z","title":"Normalized Information Distance","version":1},"cited_work":{"arxiv_id":"0809.2553","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"0809.2553","snapshot_observed_at":"2026-07-04T15:14:20.020476Z","title":null,"venue":null,"work_id":"7dca66f1-b8cf-4bbf-9307-8515ac16a4a7","year":2008},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/0809.2553","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:88776ad9d278183722c6fd4a171a6e294133ec923ab4d11bc56de3a074e57948","observation_id":"6c7bf132-f5a6-4fda-aa62-38b4fa1e5be6","resolution":{"observed_at":"2026-07-04T15:14:20.020476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fact or fiction: Verifying scientific claims","venue":null,"work_id":"a90b45a7-41fc-4145-a6b8-c9037b4c78ec","year":2020},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:a0682ad87f377d95e2d4d9cb5cf2c34cb9791978fa7b74a4a28b8e9312961f67","observation_id":"982d72b6-e128-4022-ad7d-a2dc8ba23406","resolution":{"observed_at":"2026-05-14T16:57:29.807753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:97502158140168a633c6dc3fb5c50c7da58ac138236e253d4fe4b6dc8dbd8e5c","observation_id":"fdcf104d-cc1a-4144-b8a1-40473de8f5fe","resolution":{"observed_at":"2026-05-11T04:30:57.726356Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14750","last_updated":"2026-05-31T05:30:22Z","snapshot_observed_at":"2026-08-03T09:09:48.759756Z","submitted_at":"2026-01-21T08:09:25Z","title":"Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning","version":4},"cited_work":{"arxiv_id":"2601.14750","doi":"10.48550/arxiv.2601.14750","metadata_source":"pith","pith_arxiv_id":"2601.14750","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning","venue":"cs.CL","work_id":"a3e8c06c-5aa9-4d0f-92d1-f6f6bdd30820","year":2026},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2601.14750","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:d9eba83c150c4a0f2d5518add170f4154dd337297503e68b65e97ab25543c30d","observation_id":"dd8d07a9-d579-498d-9e6a-7a6f2a463f77","resolution":{"observed_at":"2026-05-11T04:30:57.773479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-07-06T22:33:39.148066Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"cited_work":{"arxiv_id":"2510.18234","doi":"10.48550/arxiv.2510.18234","metadata_source":"pith","pith_arxiv_id":"2510.18234","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-OCR: Contexts Optical Compression","venue":"cs.CV","work_id":"e85551be-f243-4764-886f-76a8813ccbb8","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/2510.18234","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:84037e3897040c519cc56079882b677c6c803a3c460aa6a8942169b8ff812e0a","observation_id":"2b6b660b-dff1-41d6-9ee6-6848b6f831d4","resolution":{"observed_at":"2026-05-12T04:35:50.904687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"J., Yan, R., Qu, H., Li, Z., and Tang, J","venue":null,"work_id":"c97698b6-f3a5-410d-9c06-1ac854407e07","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:e4868e5f93369fba8eee7136b6e62b3f0eb873a60ba0975d4f29b9ef0fb807ea","observation_id":"db73ed4e-1e4b-4829-b941-e00ba2d0ccba","resolution":{"observed_at":"2026-05-11T04:30:57.485224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.00791","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:59:57.451557Z","title":"J., Yan, R., Shu, X., and Tang, J","venue":null,"work_id":"2e5b8447-9c61-49b2-9620-7cbb778b9062","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:fc0865acc4ddd9dd5efd29ac7dbe4b5d3a0eed61b1b1309816c81e56bde613f8","observation_id":"d539ea9d-7316-4358-952f-b17680b2ed58","resolution":{"observed_at":"2026-05-11T04:30:57.415025Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":"a3db2991-c007-4108-8987-c2040b321342","year":2018},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:ddaf9db6abdae6aa2147cb8ed88099d22f382e5d999d1eb199b4c721a8e755ab","observation_id":"21903575-33d3-4184-8c31-2c7d3b271daa","resolution":{"observed_at":"2026-05-14T16:57:29.810414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12885","last_updated":"2018-10-30T17:32:16Z","snapshot_observed_at":"2026-08-06T02:57:51.203477Z","submitted_at":"2018-10-30T17:32:16Z","title":"ReCoRD: Bridging the Gap between Human and Machine Commonsense Reading Comprehension","version":1},"cited_work":{"arxiv_id":"1810.12885","doi":"10.48550/arxiv.1810.12885","metadata_source":"pith","pith_arxiv_id":"1810.12885","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReCoRD: Bridging the Gap between Human and Machine Commonsense Reading Comprehension","venue":"cs.CL","work_id":"0490655f-8d5b-467e-83a2-568b957068c9","year":2018},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"cited_paper":"/paper/1810.12885","citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:7b0b51ca48424d0addd1f1b18b36e3481c9bf25e06a2fc3587ed6dd7f5ec6df2","observation_id":"5db83c0e-f500-40d5-aa7d-5681d459b642","resolution":{"observed_at":"2026-05-11T04:30:57.460696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Character-level convolutional networks for text classification","venue":null,"work_id":"8ce01f3b-0fac-4026-8774-734640f8688d","year":2015},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:088954af59047ca0e40f51fc5591700be3592d769607da6d809bc5ffb7625c13","observation_id":"2ce1360c-a184-4f86-b96a-5050f78ed5c8","resolution":{"observed_at":"2026-05-14T16:57:29.770414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.15649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:38:19.571773Z","title":"Vtcbench: Can vision-language models understand long context with vision-text compression? arXiv preprint arXiv:2512.15649","venue":null,"work_id":"c736976f-0ec9-4028-a54c-e0ceebbfcdb5","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:780124e1bd9e4e8609f885013473860abe188fc489cb4aeae4137f6fd5fe9783","observation_id":"108f858c-f5e6-4188-82f7-746436b00b00","resolution":{"observed_at":"2026-05-11T04:30:57.616020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ec50eb54-57ce-4ef9-a6ef-53f6f9fe6ef6","year":2021},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:8f0abca6f2eede2dc8743801b99f82cdde711c91908d3e51415ce25821dbca3d","observation_id":"f22ac084-7c7c-4860-ad4d-8c225491005d","resolution":{"observed_at":"2026-05-14T16:57:29.842971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Read the following passage","venue":null,"work_id":"91fb0166-6743-4388-9302-d6db7735ce6d","year":2025},"citing_paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:48.814483Z"},"links":{"citing_paper":"/paper/2605.06708"},"observation_digest":"sha256:855e69b011852c2ad6dbba88564274b3610f03abe1c5166b1bf2df329c7bd963","observation_id":"3727ac37-7a29-4f3d-a64e-805e56735a34","resolution":{"observed_at":"2026-05-11T04:30:57.514207Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.06708","last_updated":"2026-05-06T19:02:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T21:59:28.844275Z","submitted_at":"2026-05-06T19:02:27Z","title":"Visual Text Compression as Measure Transport"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":5,"verified_exact":20,"verified_fuzzy":25},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2605.06708."}