{"as_of":"2026-08-08T04:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d2fb14bc4a5c6c54c0a5fc5d320a61d89f76da1b84797ed0ea17ae4aae0aa2cd","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:14:02.334299Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:17:28.017071Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19714","snapshot_observed_at":"2026-08-03T04:17:28.017071Z","title":"Mt 3: Scaling mllm-based text image machine translation via multi-task reinforcement learning.arXiv preprint arXiv:2505.19714, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05547","last_updated":"2026-08-05T16:57:37Z","snapshot_observed_at":"2026-08-08T03:12:13.207542Z","submitted_at":"2026-02-05T11:06:37Z","title":"Multi-Task GRPO: Reliable LLM Reasoning Across Tasks","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T04:17:28.017071Z"},"links":{"cited_paper":"/paper/2505.19714","citing_paper":"/paper/2602.05547"},"observation_digest":"sha256:2eddc3628dc23704f607871330ce720fdabf2f52a5e4bf180f5e4c0d1e2ecf32","observation_id":"f7a59fed-1928-45ab-8d96-c5839908803a","resolution":{"observed_at":"2026-08-03T04:17:28.017071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19714/citation-record","integrity":"/paper/2505.19714/integrity","json":"/paper/2505.19714/citation-record.json","paper":"/paper/2505.19714"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:05.313562Z","title":"Improving end-to-end text image translation from the auxiliary text translation task","venue":null,"work_id":"f56c0985-9bfe-4b2b-b152-6c029ec08ed6","year":2022},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.641037Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:2662cdcbf2426b5c2ec2ce00f966b010b4b1c9149f7c4063fa5b6aa9dc5cef5a","observation_id":"7b9d031e-9169-4714-a0ac-1e375370713e","resolution":{"observed_at":"2026-08-07T14:14:05.437206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:05.098374Z","title":"Exploring better text image translation with multimodal codebook","venue":null,"work_id":"f70d7c5b-6681-42cb-a1b5-d2247de41005","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.722492Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:ee1fa6ee59c265aecd815d47c22d012729170dc9640112a3e4bb4e60b39bf3ff","observation_id":"a297e907-4ceb-4b7f-bdaa-4bad07857890","resolution":{"observed_at":"2026-08-07T14:14:05.230742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.931693Z","title":"Document image machine translation with dynamic multi-pre-trained models assembling","venue":null,"work_id":"0f20993f-56a4-43cc-bfbd-b49e05102fff","year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.863335Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:99f34e746d46a3c857c2c8189d7ec94fdbbe65b52a263b6cf0bced645ed3e8ec","observation_id":"8d0289b7-7e2d-46d4-a8b8-2a9463734673","resolution":{"observed_at":"2026-08-07T14:14:04.999357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03115","last_updated":"2025-03-02T05:16:38Z","snapshot_observed_at":"2026-08-07T13:23:30.830017Z","submitted_at":"2024-10-04T03:17:27Z","title":"X-ALMA: Plug & Play Modules and Adaptive Rejection for Quality Translation at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03115","snapshot_observed_at":"2026-08-07T14:13:58.918731Z","title":"X-alma: Plug & play modules and adaptive rejection for quality translation at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.918731Z"},"links":{"cited_paper":"/paper/2410.03115","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:2c854c69b73b84053729682cac0a50d0cb8d18048b1a8dbc9fa272bc066113d3","observation_id":"4bfba9eb-207b-4f5a-9427-16ead2573713","resolution":{"observed_at":"2026-08-07T14:13:58.918731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16379","last_updated":"2024-06-21T07:35:53Z","snapshot_observed_at":"2026-07-06T17:35:23.161066Z","submitted_at":"2024-02-26T07:58:12Z","title":"TEaR: Improving LLM-based Machine Translation with Systematic Self-Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16379","snapshot_observed_at":"2026-08-07T14:13:58.952388Z","title":"Improving llm-based machine translation with systematic self-correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.952388Z"},"links":{"cited_paper":"/paper/2402.16379","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:9396cb458d4383a80453facbb2ec04add1b91720fd32dc5aeecdbea653792b6f","observation_id":"0c29c512-5d09-4072-8db4-4edac912a1d6","resolution":{"observed_at":"2026-08-07T14:13:58.952388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.724375Z","title":"Towards fully automated manga translation","venue":null,"work_id":"497e2ccc-0b78-40db-808b-b993a9471a22","year":2021},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.051159Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:7f7e8e8e68406212c1805cf1c0596b1ebeb04b2802a9e76528d771062ac56b82","observation_id":"2db436a2-94c8-4f04-a1e7-f478d1825759","resolution":{"observed_at":"2026-08-07T14:14:04.822417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.489730Z","title":"Doc-handler: Document scanner, manipulator, and translator based on image and natural language processing","venue":null,"work_id":"f5458be5-4ee2-44de-a05f-a63835343387","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.138157Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:75618a499af4682d1ce0e9870534881c3468d4a33ceacbb3a7a2aaf83a5a1fba","observation_id":"b88b2cfb-05ff-4100-b79b-c6f58616f4e2","resolution":{"observed_at":"2026-08-07T14:14:04.602806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.348893Z","title":"A novel dataset and benchmark analysis on document image translation","venue":null,"work_id":"d1ea4fb9-b994-44c6-aa69-c9b090073897","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.242079Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:c555ab593e6afe03e466724ea2bf88939ed554da6cfb194cb8e90ad2f42db9ee","observation_id":"fcbd4c83-9b94-4581-8147-d3779a3ffeb4","resolution":{"observed_at":"2026-08-07T14:14:04.437848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.215011Z","title":"Understand layout and translate text: Unified feature-conductive end-to-end document image translation","venue":null,"work_id":"d36c9309-e410-44dc-88d6-76534121c256","year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.329408Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:0496fac4623d74bed015fc8efd0bb8c1a4fa87ddfac08ceced14d5b366ee3e3d","observation_id":"84599604-fd47-42d1-80e3-94fe0accb12b","resolution":{"observed_at":"2026-08-07T14:14:04.266082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.058196Z","title":"Peit: bridging the modality gap with pre-trained models for end-to-end image translation","venue":null,"work_id":"71493064-7792-4e77-969c-81ab24af99bd","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.452079Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:dc66d21346a591288219e8456929f613a48b0a48f01f0eee4ca862af4fb22c1f","observation_id":"fa117ddf-2327-4491-8ab4-d939013c384e","resolution":{"observed_at":"2026-08-07T14:14:04.142137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.860921Z","title":"Born a babynet with hierarchical parental supervision for end-to-end text image machine translation","venue":null,"work_id":"884bf016-7fd0-453b-bfc3-46bc999ada9a","year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.605511Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:57ac79ec990536480fd4bde84f435c3ac37d6c11a068a5d44ec9719f9c2ab747","observation_id":"7eb808bc-a1d9-4499-83d1-9063bd20ccbd","resolution":{"observed_at":"2026-08-07T14:14:03.928447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.714743Z","title":"Umtit: Unifying recognition, translation, and generation for multimodal text image translation","venue":null,"work_id":"4bb63c5b-9fcd-4f08-801a-bbe1860338f2","year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.691677Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:cd93af73fbf939834e1fd30150d10a33e13efed763aea04e40dd6d4204054eb9","observation_id":"f2fd6f25-9fe1-4f6d-b18a-b04a8c1aefe9","resolution":{"observed_at":"2026-08-07T14:14:03.772522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:13:59.814191Z","title":"Qwen2.5-vl technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.814191Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:2ffe4fafc4cd2cdf230691ef658fe7a883b3caeb66d597f06586394a0f671036","observation_id":"7db1058f-f4c4-492b-bc71-e42c40294a12","resolution":{"observed_at":"2026-08-07T14:13:59.814191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T14:13:59.949559Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.949559Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:bf49278e4aa2eac65b23f6bb7a1c369f7baea716dc633385fa2f40db6e3bee11","observation_id":"2bf1845f-f9b1-4086-930c-d38c6ee018da","resolution":{"observed_at":"2026-08-07T14:13:59.949559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:00.084026Z","title":"Qvq: To see the world with wisdom, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.084026Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:498498c06d32aaa43a3bcb61d4be092edaf9c6c5e4ec3d3feee992b69f17207d","observation_id":"011e98e9-b803-431d-82c9-185df12c0503","resolution":{"observed_at":"2026-08-07T14:14:00.084026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:14:00.195720Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.195720Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:d330949d086a40a56ed841c1d0d400127c4d30b65ad20958eda82011499a69e9","observation_id":"f47fd1cf-41f0-418d-b310-a04514489007","resolution":{"observed_at":"2026-08-07T14:14:00.195720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.551122Z","title":"Kimi k1.5: Scaling reinforcement learning with llms","venue":null,"work_id":"4928b274-bacc-408f-b6fc-473bb2b96e91","year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.301704Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:c7c8471bf0c5d0134abfe9fab36d2600c924f1b36252a8f3cdbc195eacf84554","observation_id":"f9f90ec2-3c9e-46b9-b572-a7f041e22ada","resolution":{"observed_at":"2026-08-07T14:14:03.612372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:00.396181Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.396181Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:f6d733978271dae258d1f8956c57208a2071a68bc98b46ae3d95daa42fb46d7a","observation_id":"0bd6ec55-df4d-4264-8d83-b82c5cc732ea","resolution":{"observed_at":"2026-08-07T14:14:00.396181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T14:14:00.498814Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.498814Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:37019ccaeb85ee2649bb43f4b33c0a3dabbe9f3c08632b8bc36b8a6e55259a18","observation_id":"a5f2a814-4646-4e86-909d-c9f07717bcc1","resolution":{"observed_at":"2026-08-07T14:14:00.498814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-06T21:34:54.534751Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-07T14:14:00.582740Z","title":"R1-vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.582740Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:47ae27212370a40bdeaf5ef8e725d1d650e078742964b17d3213efc9865ee140","observation_id":"3398ef41-7d5f-4aed-8636-b2a1051d9b93","resolution":{"observed_at":"2026-08-07T14:14:00.582740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T14:14:00.742150Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.742150Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:3fb4bc1e3f2dc35f2ccef25439584a40ac05daee3784ff36614810a7ed7932ec","observation_id":"747cb31e-cc82-47f3-81d3-efbbbd61326d","resolution":{"observed_at":"2026-08-07T14:14:00.742150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-05T03:13:54.147007Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01785","snapshot_observed_at":"2026-08-07T14:14:00.855627Z","title":"Visual-rft: Visual reinforcement fine-tuning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.855627Z"},"links":{"cited_paper":"/paper/2503.01785","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:30c2347dc7410bf1f4ae3770c6b4db088b30fab6d1e1a80462bccc54529be2fa","observation_id":"cc78ef3e-8682-4e19-a0e3-0d45b7c6a15e","resolution":{"observed_at":"2026-08-07T14:14:00.855627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T14:14:00.965350Z","title":"Mm-eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.965350Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:97ec1f8370882f2c096d3a1470761aacf30d6fc5496ff9b94826ab4d9e413722","observation_id":"7fa60082-4020-47cd-b5bb-c0f92981b7ad","resolution":{"observed_at":"2026-08-07T14:14:00.965350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:01.061657Z","title":"R1-v: Reinforcing super generalization ability in vision-language models with less than \\ 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.061657Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:514749aefd110e04b7ccc3c3b22b497b96e2aced0660677dcb1a9a6ae37e6bfa","observation_id":"843b5793-aed7-4f43-b81c-4b2f26517bdc","resolution":{"observed_at":"2026-08-07T14:14:01.061657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07147","last_updated":"2024-12-16T09:28:53Z","snapshot_observed_at":"2026-08-07T05:02:51.697949Z","submitted_at":"2024-12-10T03:12:35Z","title":"MIT-10M: A Large Scale Parallel Corpus of Multilingual Image Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07147","snapshot_observed_at":"2026-08-07T14:14:01.162482Z","title":"Mit-10m: A large scale parallel corpus of multilingual image translation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.162482Z"},"links":{"cited_paper":"/paper/2412.07147","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:dc954f059c33fe8f3ef04cb9d66c8be52021efe11782b6dfbd17c2c3b252b74f","observation_id":"94e68b34-4a67-44e6-b338-989af900c6ee","resolution":{"observed_at":"2026-08-07T14:14:01.162482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T14:14:01.267361Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.267361Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:724e076b6da153f6b79e8faa4302c2d67019feaf00905924cc1c0343daedcb73","observation_id":"42d4d390-4d3c-4478-8d98-9318e8527c08","resolution":{"observed_at":"2026-08-07T14:14:01.267361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:14:01.404958Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.404958Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:40a5bf0201c5c9b92a2881255149c1460f6c83ab448ee2bd494d732a04895c34","observation_id":"3bb5ca55-f5fb-441c-a276-f01b8b9e0538","resolution":{"observed_at":"2026-08-07T14:14:01.404958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.387164Z","title":null,"venue":null,"work_id":"6b665b0b-72d3-433a-aa91-3191b690ff92","year":2022},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.507949Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:23d3d9f0d542c2ed21ce2767f9abc69ff6ddcab4d1a5b25321b6835f90183c1b","observation_id":"a06f41ee-f846-40e9-bd74-d419b355d93a","resolution":{"observed_at":"2026-08-07T14:14:03.447765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:01.629109Z","title":"Results of WMT 23 metrics shared task: Metrics might be guilty but references are not innocent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.629109Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:bf1b6aeb7987132a372379bcddc21ee9d3ca981d28b820f0aa3977581e271ef9","observation_id":"9bfd95f3-3fcb-46c7-be81-a6b2b414545c","resolution":{"observed_at":"2026-08-07T14:14:01.629109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10160","last_updated":"2025-04-14T12:14:18Z","snapshot_observed_at":"2026-08-07T16:05:55.084744Z","submitted_at":"2025-04-14T12:14:18Z","title":"MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10160","snapshot_observed_at":"2026-08-07T14:14:01.716379Z","title":"Mt-r1-zero: Advancing llm-based machine translation via r1-zero-like reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.716379Z"},"links":{"cited_paper":"/paper/2504.10160","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:b2ab8bf74bbadef88bb0f67d96fa2a37cbdd7fa29d9e0c1d035e17905ffcd9af","observation_id":"25423da9-622c-4e82-b194-c93f4694c9a8","resolution":{"observed_at":"2026-08-07T14:14:01.716379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:01.816152Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.816152Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:137a41ff1b56b759326dcf97d85d0fe6405a412095c7cc6f63a73a2840e06476","observation_id":"a70b5dee-780a-4925-ba71-b32baa6ae6a3","resolution":{"observed_at":"2026-08-07T14:14:01.816152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.208311Z","title":"A call for clarity in reporting BLEU scores","venue":null,"work_id":"6e0244d7-7b09-48c6-85e4-e15cd832c625","year":2018},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.887679Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:b826e1a280464cf8dfcf7c0358762fa3ec531ef9885a1f9cc176efe54ba094aa","observation_id":"814b935f-bf68-4e35-a9bc-0bb090857f4f","resolution":{"observed_at":"2026-08-07T14:14:03.300772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.063190Z","title":"chrf++: words helping character n-grams","venue":null,"work_id":"e7b52174-c958-4957-ae58-3db8920545c5","year":2017},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.929513Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:fc4dd84097e3ae2509c5de8807901fee22ed4957323aa56d62b37ce2444e2fb7","observation_id":"80f028a1-8817-42d7-bc7e-81395417c64e","resolution":{"observed_at":"2026-08-07T14:14:03.129649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:02.891446Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":"de925b56-7137-48fd-ad69-86722f7c4d7e","year":2005},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.986290Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:45a519c34e7fba3ad14ef82f9881bb0d89f9af8270575ab304881c9d19eb35f9","observation_id":"fbcc3b8e-3264-4326-8858-a49a43a0420d","resolution":{"observed_at":"2026-08-07T14:14:02.982521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-08-07T17:13:10.057242Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00321","snapshot_observed_at":"2026-08-07T14:14:02.099149Z","title":"Ocrbench v2: An improved benchmark for evaluating large multimodal models on visual text localization and reasoning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.099149Z"},"links":{"cited_paper":"/paper/2501.00321","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:dd15a57af654f5c253894f143bac5a783e70784868f1426c5caf756203fd11dd","observation_id":"b1ba5894-f2a8-4e0a-96b1-97ec66c90f86","resolution":{"observed_at":"2026-08-07T14:14:02.099149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:14:02.163845Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.163845Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:37b519c24b4c7315d5ed978ee3af91c1097f49ea18a0f905ce890974c88996a9","observation_id":"5967fad5-0f27-4407-8282-6a21ff33cf33","resolution":{"observed_at":"2026-08-07T14:14:02.163845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-07T14:14:02.254773Z","title":"No language left behind: Scaling human-centered machine translation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.254773Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:731a82bbf3125cf3a5c63eda013ae063712a5bd478fdeb0f62d6a61e2b3e9b43","observation_id":"4990aa5c-23f1-4509-ab9d-3c5349673d46","resolution":{"observed_at":"2026-08-07T14:14:02.254773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:02.733850Z","title":"Deep nn for nsfw detection","venue":null,"work_id":"f8c3de16-11da-4995-b8d1-916bf2e49b50","year":null},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.334299Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:1dfce4339d28c4aff29faa13b33b2f6860b68f2657616ae0c5b25016759d00e8","observation_id":"ea34ad3b-0316-42a7-a15a-ce7bdd82a941","resolution":{"observed_at":"2026-08-07T14:14:02.804453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:05:21.471264Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.19714."}