{"as_of":"2026-08-21T13:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:551ac5e512781343918c2230149de36560dea390e4b612dd64556aff6903e80e","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:25:22.051935Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29397/citation-record","integrity":"/paper/2607.29397/integrity","json":"/paper/2607.29397/citation-record.json","paper":"/paper/2607.29397"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.900431Z","title":"Findings of the WMT 2024 Shared Task of the Open Language Data Initiative","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.900431Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:97c95fbb6ef4ffacbc7fc0da4d0c7f0fecd76299620f0d925ccddd345cc54e80","observation_id":"f5a2638c-a20f-49a7-9ec6-f76a6afa57d4","resolution":{"observed_at":"2026-08-05T04:25:21.900431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.905152Z","title":"Findings of the WMT 2025 Shared Task of the Open Language Data Initiative","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.905152Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:78fbf52a480338ebb4fa54482cc077e577b03b36324a214dda8fdd0d1c939df5","observation_id":"7f746b67-ca78-4cd9-bc6c-98b4a80d33e8","resolution":{"observed_at":"2026-08-05T04:25:21.905152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.907865Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.907865Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:345159c1dd55e6b607974072efb938011d8ccb2d11bfb9432eccce54ba6a6e03","observation_id":"2d9bbc97-e978-42a1-b33c-a5f3970b5e1b","resolution":{"observed_at":"2026-08-05T04:25:21.907865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.645435Z","title":null,"venue":null,"work_id":"4046d113-e0e6-491b-b705-07c4beec12d8","year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.910459Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:df94e3f2d26185737a07e559b4bbb4353a1f52fc4e1b45598a55a0cf7c719a83","observation_id":"db4701a5-06c3-466f-a7ed-d677233c01a4","resolution":{"observed_at":"2026-08-05T04:25:22.648475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.913010Z","title":"arXiv preprint arXiv:2509.25149 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.913010Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:ed460e70355dfec7ca0107c4fd334e8993aaf23a0e9741b6aac83f6229053f67","observation_id":"c984c4b1-8a1b-4a2b-94aa-3ada0c66b336","resolution":{"observed_at":"2026-08-05T04:25:21.913010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T04:25:21.915522Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.915522Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:4471dbb2e46e63ff6c73bb37b23102d439bb9d16b047bc147b9c9392a4381c8c","observation_id":"fbf209af-ce07-466b-b7f4-5bb795fd248c","resolution":{"observed_at":"2026-08-05T04:25:21.915522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.918419Z","title":"18th USENIX symposium on operating systems design and implementation (OSDI 24) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.918419Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:11f089b9fe656608ceeca0a7d6dd884ba78fd0cf389b2f0c8cebdd20719b0431","observation_id":"2f40f417-a2ce-4abc-b6d1-817c35b31d0f","resolution":{"observed_at":"2026-08-05T04:25:21.918419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-14T04:51:04.817737Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-05T04:25:21.921055Z","title":"arXiv preprint arXiv:1308.3432 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.921055Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:d50eab240586423ed617df68a731e0c9c6f5cf7d40e183ab1c14ef4dc2a8ffc0","observation_id":"d17cc002-3af4-43a1-8582-5908e689bfd8","resolution":{"observed_at":"2026-08-05T04:25:21.921055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.631217Z","title":"Proceedings of the 14th International Conference on Spoken Language Translation , pages=","venue":null,"work_id":"0814f747-c9a7-4152-ba77-5bffbecace5c","year":2017},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.923913Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:c273c16d71f207cb9e77fc987a10a2ef56767909024b8cbe772c349c195a35f1","observation_id":"6d482d6c-1b43-4f39-89e2-799840c30d46","resolution":{"observed_at":"2026-08-05T04:25:22.634587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13618","last_updated":"2025-08-21T13:08:01Z","snapshot_observed_at":"2026-08-15T19:32:50.658505Z","submitted_at":"2025-07-18T03:19:43Z","title":"Seed-X: Building Strong Multilingual Translation LLM with 7B Parameters","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13618","snapshot_observed_at":"2026-08-05T04:25:21.926406Z","title":"arXiv preprint arXiv:2507.13618 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.926406Z"},"links":{"cited_paper":"/paper/2507.13618","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:9820fccfffd15bd0dbeb5fce1cccf41c6842d1a0abf22060b81f907fdb96f09c","observation_id":"b8a5f8b5-3c7d-4a75-9fbd-40c8d0cddd2e","resolution":{"observed_at":"2026-08-05T04:25:21.926406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.623491Z","title":"IEEE Micro , volume=","venue":null,"work_id":"c6fb2315-5504-419c-8c64-341c728d7c87","year":2023},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.929315Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:5354fbc914edb917e6823be233d9f051ae1516f14a7f494845f860fe873872fd","observation_id":"7ec29f32-741c-4185-a016-a6964108cd0b","resolution":{"observed_at":"2026-08-05T04:25:22.625975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.932428Z","title":"Proceedings of the 28th international conference on evaluation and assessment in software engineering , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.932428Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:65defb47d4cc27fceafbd702f3653d3514f3083bcb698a9cb2cd6a4d9445fe87","observation_id":"8a45ffec-a784-47df-97f1-946938c8033a","resolution":{"observed_at":"2026-08-05T04:25:21.932428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.612166Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":"dec58dbe-67e1-45ff-a723-9c7248cd1240","year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.934884Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:6bed1aa1685203a77f6afb3db439327398056b76bfce9a6bff82bcc40acff725","observation_id":"a57bc1bf-118a-4750-af31-090dca7909a0","resolution":{"observed_at":"2026-08-05T04:25:22.614925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17415","last_updated":"2024-10-28T08:59:01Z","snapshot_observed_at":"2026-08-18T08:54:18.880151Z","submitted_at":"2024-06-25T09:37:15Z","title":"Layer-Wise Quantization: A Pragmatic and Effective Method for Quantizing LLMs Beyond Integer Bit-Levels","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17415","snapshot_observed_at":"2026-08-05T04:25:21.937482Z","title":"arXiv preprint arXiv:2406.17415 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.937482Z"},"links":{"cited_paper":"/paper/2406.17415","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:61632dd5c08cf3c349335a4210335a70f038d272684e622abcd8751d62aa715b","observation_id":"efddbf83-b70d-4851-91f2-487e58417a44","resolution":{"observed_at":"2026-08-05T04:25:21.937482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T04:25:21.940848Z","title":"arXiv preprint arXiv:2210.17323 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.940848Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:845dc67dc4a56337557a036ea423245cd2ad54b5ba280651ab7a85109afa021d","observation_id":"3da8d404-b602-4afd-bc1a-b0223f2da432","resolution":{"observed_at":"2026-08-05T04:25:21.940848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.943474Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.943474Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:f1a117220279a013b8e67f32e7664684a0f136da93ef3b2f71048ddf8d5073ce","observation_id":"1c0c46ed-3a9f-490f-b50a-a548306b57cf","resolution":{"observed_at":"2026-08-05T04:25:21.943474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T04:25:21.946023Z","title":"arXiv preprint arXiv:1503.02531 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.946023Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:02ca4fcce1488090964e3b370ab1f31e5b42b123364df48deac39c03b73ec113","observation_id":"070d692b-95a3-4f57-a3bc-ca92514c652a","resolution":{"observed_at":"2026-08-05T04:25:21.946023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.948776Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.948776Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:ff6ee888da3b0c75ec8cdb55f29879839017dc07a6c16097f54994158ddfb961","observation_id":"50d69927-c640-4fdb-ae0b-dc67f37480c0","resolution":{"observed_at":"2026-08-05T04:25:21.948776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.596157Z","title":"2026 IEEE International Parallel and Distributed Processing Symposium (IPDPS) , pages=","venue":null,"work_id":"dec917dd-6d7d-49f3-bf81-310ab98c2f8e","year":2026},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.951633Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:034263e6a83d0917a3efd43305aa6a879b7aaab5b0ae0ac7e1fd72715a143e85","observation_id":"d0108ea6-0814-4384-8466-fc894287a8cd","resolution":{"observed_at":"2026-08-05T04:25:22.598924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.588426Z","title":"Proceedings of the Eighth Conference on Machine Translation , pages=","venue":null,"work_id":"2d0b316a-996d-41b9-90e8-b0c483435215","year":2023},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.954120Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:39f24e7e328673999935a77b951a82eb85bbad542b6f4e6b0e982bb49c7d591f","observation_id":"c2365d77-0692-4ddf-823b-a0328cb6735c","resolution":{"observed_at":"2026-08-05T04:25:22.591131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.956428Z","title":"Large Language Models Effectively Leverage Document-level Context for Literary Translation, but Critical Errors Persist","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.956428Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:ac78aa91ef1659fc96c2e55ec77f03e6fa5c0d5a49909b1d234782ce36bb8002","observation_id":"aeb29ac0-b364-46f3-8f4f-466af83d524d","resolution":{"observed_at":"2026-08-05T04:25:21.956428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T04:25:21.959829Z","title":"arXiv preprint arXiv:1412.6980 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.959829Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:2410978ac4dfc2aba03b5604ba3412df1287df983e6b54fe423998c2ef4f2f85","observation_id":"5c67e858-869b-49be-a7ca-53c03023449b","resolution":{"observed_at":"2026-08-05T04:25:21.959829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.962394Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.962394Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:95fc3c73ecd319e1aafea9481a00cac65cf9d5b8e491c0cd4fa9dd8dfb07a96d","observation_id":"fb33ec8d-7db0-4d30-bab1-c7c40be980c6","resolution":{"observed_at":"2026-08-05T04:25:21.962394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.964750Z","title":"Has Machine Translation Achieved Human Parity? A Case for Document-level Evaluation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.964750Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:faf08e813edc06092d9cc8913d50a90ddc62d217bbe50c8f21f9baef9e3afb43","observation_id":"d04996fb-adcb-48ad-99c6-6a84ce5b5b49","resolution":{"observed_at":"2026-08-05T04:25:21.964750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.576394Z","title":"GetMobile: Mobile Computing and Communications , volume=","venue":null,"work_id":"7d825fc2-fc4d-43de-91f0-634780af5a89","year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.967366Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:daf457fd2391eeb6e0d0d32bf83f9d1bcf725a49969ea7cfb14292664c0248d8","observation_id":"9706702b-4092-46de-ad0d-90795e3a3208","resolution":{"observed_at":"2026-08-05T04:25:22.579230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-16T14:14:37.272762Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T04:25:21.969659Z","title":"arXiv preprint arXiv:2402.18158 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.969659Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:898db2731a41703fafc666ee5bd5da313fbd0167d278df15c9814be82dbbc249","observation_id":"21f944eb-a174-4f2c-8927-6569e53c812e","resolution":{"observed_at":"2026-08-05T04:25:21.969659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15692","last_updated":"2025-03-05T10:54:30Z","snapshot_observed_at":"2026-08-15T22:50:14.505857Z","submitted_at":"2024-11-24T03:06:59Z","title":"DrugAgent: Automating AI-aided Drug Discovery Programming through LLM Multi-Agent Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15692","snapshot_observed_at":"2026-08-05T04:25:21.972274Z","title":"arXiv preprint arXiv:2411.15692 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.972274Z"},"links":{"cited_paper":"/paper/2411.15692","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:9ac72bd8e8b7236bd3fc91827ccddff093bd3016a925a874f63948ba929974cc","observation_id":"3a9f2504-5da8-478b-bdb1-5b607e265771","resolution":{"observed_at":"2026-08-05T04:25:21.972274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.974848Z","title":"Transactions of the association for computational linguistics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.974848Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:1df98ca636305700cc91c45493b92fd59138d76a910c74f19083e16a90e20a38","observation_id":"0eff28ed-ca58-4b31-9888-837f56575a04","resolution":{"observed_at":"2026-08-05T04:25:21.974848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.565127Z","title":"Nature medicine , volume=","venue":null,"work_id":"018a7e74-d548-4df3-9792-3195dfd46fbb","year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.977160Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:1ccf446a13baf56ae7768f014d60e2b98de7c6cd5724b104df7a4b342280002c","observation_id":"f9f6c920-1d89-4404-b5d7-c9d9e659bed0","resolution":{"observed_at":"2026-08-05T04:25:22.567775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.556414Z","title":"Amin and Bawden, Rachel and Zhang, Michael and Martins, Andr \\'e F","venue":null,"work_id":"2113accd-788d-48f8-8a4b-3a2a88343f6c","year":2020},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.979539Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:648bbae906348df7738534837f0ad5ebb2c1e0b331447767a58bfb88c11942b9","observation_id":"f3e0e7b1-4dae-4b41-9ffa-cddc187800bc","resolution":{"observed_at":"2026-08-05T04:25:22.559501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-14T15:17:37.878305Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T04:25:21.981921Z","title":"arXiv preprint arXiv:2402.17764 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.981921Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:38cd5b778847e3325ed9334cfb9f9c02f6bd78cf545f6b2b99fbeb6f95e39d61","observation_id":"fff4e2a5-5f11-4050-af5a-dcd1da594190","resolution":{"observed_at":"2026-08-05T04:25:21.981921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.548553Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages=","venue":null,"work_id":"4854f0ac-99a0-46d9-8a10-1c6ad4986404","year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.984531Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:3f11b9a9f0ee06c0dc9051750a7ccec79bfa3c299347e1352bddbeb18414c259","observation_id":"0aee26ab-f50b-4be1-a8a0-6fcc77dd8901","resolution":{"observed_at":"2026-08-05T04:25:22.551510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20893","last_updated":"2025-08-28T15:22:31Z","snapshot_observed_at":"2026-08-10T09:09:25.763510Z","submitted_at":"2025-08-28T15:22:31Z","title":"The Uneven Impact of Post-Training Quantization in Machine Translation","version":1},"cited_work":{"arxiv_id":"2508.20893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20893","snapshot_observed_at":"2026-08-05T04:25:22.359214Z","title":"The Uneven Impact of Post-Training Quantization in Machine Translation","venue":"cs.CL","work_id":"36a59a4c-90b1-4b61-8232-f8f268f9ede6","year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.987031Z"},"links":{"cited_paper":"/paper/2508.20893","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:c68d683fadc1fbf982a6208635c7a1141d6d3d8ed524bdf14d75e0f461c80b80","observation_id":"a178b19e-5548-45d5-95b4-86d5cc2652a9","resolution":{"observed_at":"2026-08-05T04:25:22.362475Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.989601Z","title":"Procedia Computer Science , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.989601Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:ca03fde7556d02bea6e4d72850541751f1d035c1e02ee14c821be5a12779cfdc","observation_id":"c71d9ad5-1458-4984-8da4-c467dfc4b715","resolution":{"observed_at":"2026-08-05T04:25:21.989601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.536764Z","title":"ACM Computing Surveys (CSUR) , volume=","venue":null,"work_id":"b590872f-4ac6-4d7d-a662-3cc1671e07d2","year":2021},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.992311Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:4fb7c9238becb313a62187a87ef4f908e0697a06e6e34fb52fadffb0e95e8062","observation_id":"5df5241d-5b04-4796-983a-80a545225b98","resolution":{"observed_at":"2026-08-05T04:25:22.539516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15563","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.347857Z","title":"arXiv preprint arXiv:2602.15563 , year=","venue":null,"work_id":"27f5a95f-ec86-4bdf-9ec2-aa767a861c92","year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.994649Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:c23ae19affb250499a84097f33ca5cba987d4980b875a283903dfe217f47e138","observation_id":"185d96c3-5eab-427b-b206-3cbb8824bf07","resolution":{"observed_at":"2026-08-05T04:25:22.351824Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.529001Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":"69d763c2-a237-483a-a63c-6691b227607d","year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.997081Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:6a3244ba442ab606fdda7b57e3965f3b5880bf152b40b5a74cce85f0dbc3735c","observation_id":"134afb40-8f2f-4379-87f7-80fbff3bb4f6","resolution":{"observed_at":"2026-08-05T04:25:22.532302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:21.999636Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.999636Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:b7a71cf30307cbda775e40acb13deaba4a9d451b83675950bf70b592d064a4e9","observation_id":"5954ec41-3549-4e36-ba54-4ae43a57da2f","resolution":{"observed_at":"2026-08-05T04:25:21.999636Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T04:25:22.001910Z","title":"arXiv preprint arXiv:2203.02155 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.001910Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:01bc95d65e338ed677f319b65a4f6b249b6524a4b226704f01dc91d2fba3274c","observation_id":"a6a2e3a2-60f5-454d-b513-a6dd2e2bf239","resolution":{"observed_at":"2026-08-05T04:25:22.001910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.004583Z","title":"Proceedings of the 40th annual meeting of the Association for Computational Linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.004583Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:18716724e6cb0ad6f7800a2de4b1988035df14d870a841a09f89e7e7aa711173","observation_id":"5dac07a1-b6ee-4226-835a-ca1319ce2d1e","resolution":{"observed_at":"2026-08-05T04:25:22.004583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.007143Z","title":"Proceedings of the second conference on machine translation , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.007143Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:8b2941a5189907d4108785f64fbfc513b82e72060e7596d30ae288d69253b207","observation_id":"01d3b697-5aea-4d54-9fc5-fd2f6c12eac7","resolution":{"observed_at":"2026-08-05T04:25:22.007143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.510115Z","title":"Findings of the Association for Computational Linguistics: NAACL 2025 , pages=","venue":null,"work_id":"e0241c15-08f4-40d0-89f2-673e479e482c","year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.009561Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:4375affe65b71f23e25ec485acfe82715bae6d09dadced5b2b591b4282f8219a","observation_id":"6a973293-4b87-4e0e-b501-228296a6e0d7","resolution":{"observed_at":"2026-08-05T04:25:22.513023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10537","last_updated":"2023-10-19T16:38:33Z","snapshot_observed_at":"2026-08-19T14:12:52.683965Z","submitted_at":"2023-10-16T16:07:41Z","title":"Microscaling Data Formats for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10537","snapshot_observed_at":"2026-08-05T04:25:22.011849Z","title":"arXiv preprint arXiv:2310.10537 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.011849Z"},"links":{"cited_paper":"/paper/2310.10537","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:75d2296fb47f49c8c555528ee36641b51ffec586560a88cd8cf96b71fb43c285","observation_id":"a406126b-0fa0-4da3-ba75-2c0fab223ca1","resolution":{"observed_at":"2026-08-05T04:25:22.011849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.502246Z","title":"Proceedings of the 17th International Conference on Computational Processing of Portuguese (PROPOR 2026)-Vol","venue":null,"work_id":"7848aeab-f684-45b6-b5fd-5ae9b8a8c884","year":2026},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.014534Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:7b13cd1ee93190b8fb33e1ffb69103fb71058fda02bb010388b3ebf565d36b91","observation_id":"554ea48f-dc34-47f9-8d88-d266c2e84890","resolution":{"observed_at":"2026-08-05T04:25:22.505479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.016807Z","title":"Neurocomputing , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.016807Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:1b33aec647ca6e95a5599f887f6a03ece534e437d278be0d3027c7db79af6d48","observation_id":"69876074-844d-4747-9e1e-5b8800521582","resolution":{"observed_at":"2026-08-05T04:25:22.016807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.490490Z","title":"Proceedings of the 19th Annual Conference of the European Association for Machine Translation: Projects/Products , year=","venue":null,"work_id":"7028a8f9-51c6-4c48-af8b-08f754a6ea87","year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.019174Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:01a3d8f864ca2997ffc738eb6ef37ed729632e860cff5852dd14cdf8336fbf4a","observation_id":"b4cd2f5d-52e9-4ac1-a9cc-bef8032fe6ad","resolution":{"observed_at":"2026-08-05T04:25:22.493757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T04:25:22.021552Z","title":"arXiv preprint arXiv:2302.13971 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.021552Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:d058439e00004f2d8f143be3d023f5b045e090cba844d5ee7496a0cd964b3eab","observation_id":"897527c6-2bd5-424f-821c-57767e6e2b41","resolution":{"observed_at":"2026-08-05T04:25:22.021552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.024884Z","title":"The Bottom-up Evolution of Representations in the Transformer: A Study with Machine Translation and Language Modeling Objectives","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.024884Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:6bc5c9f7259cecbe832c61ba268576bbd03a24634f882a742f21334d085e16f0","observation_id":"02f8c269-52bc-40c5-a0bd-9164a27a32f8","resolution":{"observed_at":"2026-08-05T04:25:22.024884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.027476Z","title":"Document-Level Machine Translation with Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.027476Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:d5b8b1b86c49b5651978033f23f6491cbe5d962be4550b85fcd0ad5ab0686690","observation_id":"9c740e18-7f4f-4fe0-99e2-008c036e8e49","resolution":{"observed_at":"2026-08-05T04:25:22.027476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13476","last_updated":"2024-11-26T09:46:25Z","snapshot_observed_at":"2026-08-19T06:11:16.023977Z","submitted_at":"2024-11-20T17:22:31Z","title":"When Precision Meets Position: BFloat16 Breaks Down RoPE in Long-Context Training","version":2},"cited_work":{"arxiv_id":"2411.13476","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13476","snapshot_observed_at":"2026-08-05T04:25:22.268967Z","title":"When Precision Meets Position: BFloat16 Breaks Down RoPE in Long-Context Training","venue":"cs.CL","work_id":"ad7a1df9-3c60-4d0e-a58a-dd35f1fd23e1","year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.029871Z"},"links":{"cited_paper":"/paper/2411.13476","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:1e13a4d0a85235abff89cad871243eba1f42a12bef4170a6148fbefdd616cae2","observation_id":"6d58c89b-c0d0-4fd1-9907-448e05f2a55e","resolution":{"observed_at":"2026-08-05T04:25:22.273934Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-08-15T04:43:14.762539Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-05T04:25:22.032406Z","title":"arXiv preprint arXiv:2310.11453 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.032406Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:c6ae3510c554f5d73553315546f816b0ac60bba8413ac4afac5d600f43e3ea92","observation_id":"04547caf-33d9-435d-bb32-145bd0ae45c8","resolution":{"observed_at":"2026-08-05T04:25:22.032406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.034997Z","title":"arXiv preprint arXiv:2510.13998 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.034997Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:935b458df36fdbecca8c2ea430d70b14da78be7dfdb5945d9178760f704a9a1a","observation_id":"9ffcc10b-728e-404b-8a35-44ab349d82ae","resolution":{"observed_at":"2026-08-05T04:25:22.034997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.037262Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.037262Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:13f6495c49cd7ce8dec092e0edc8a5490f7878904d3dfb3920819a810f66ecb4","observation_id":"6937b958-c815-4909-9c21-4a7c0f9986c3","resolution":{"observed_at":"2026-08-05T04:25:22.037262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.039627Z","title":"arXiv preprint arXiv:2601.20088 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.039627Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:c5aac726deed0be202c9a8eaa9759fdd4dfa02a6d8e5368314088729f362ef6f","observation_id":"cfacc223-ec2d-4665-a83e-a8ba8b03cdd6","resolution":{"observed_at":"2026-08-05T04:25:22.039627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.041895Z","title":"16th USENIX symposium on operating systems design and implementation (OSDI 22) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.041895Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:d6bbdac0f59d545829e651ce70a77a944fdcc0babee1e6039e02f2326f0a2254","observation_id":"23dd1728-29ef-4d25-a427-806c51595d13","resolution":{"observed_at":"2026-08-05T04:25:22.041895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.475166Z","title":"2025 International Joint Conference on Neural Networks (IJCNN) , pages=","venue":null,"work_id":"97ecfa47-5579-4fb9-8867-44e398d7c6b1","year":2025},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.044307Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:2d609baeda44e6aa33d744617b683f15464f951781565f7e71ab2e0eb268c197","observation_id":"8f26e2a9-18c8-4e78-878c-fb0a2b7de6fc","resolution":{"observed_at":"2026-08-05T04:25:22.478004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:25:22.466574Z","title":"2024 IEEE International Conference on Multimedia and Expo (ICME) , pages=","venue":null,"work_id":"03d41fb9-6845-46f7-95b4-c94fd6a5dcd6","year":2024},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.046830Z"},"links":{"citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:a24627854d6e1807ca8ccc8058434219fd1858d611adace8629d18f8a13d20d9","observation_id":"52cd6a55-f857-429d-8c91-b7b981a68c0f","resolution":{"observed_at":"2026-08-05T04:25:22.469529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09904","last_updated":"2024-07-31T07:35:42Z","snapshot_observed_at":"2026-08-16T13:43:00.924146Z","submitted_at":"2024-06-14T10:23:45Z","title":"QQQ: Quality Quattuor-Bit Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09904","snapshot_observed_at":"2026-08-05T04:25:22.049357Z","title":"arXiv preprint arXiv:2406.09904 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.049357Z"},"links":{"cited_paper":"/paper/2406.09904","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:89bf4e5e7580241d150b59b0306c0347aa44d473586dd9fc29c90a4783481ad4","observation_id":"96a2a206-7936-4f44-87df-514c8351bf6a","resolution":{"observed_at":"2026-08-05T04:25:22.049357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22064","last_updated":"2026-05-25T03:05:16Z","snapshot_observed_at":"2026-08-17T15:41:10.392878Z","submitted_at":"2026-05-21T07:00:06Z","title":"Hy-MT2: A Family of Fast, Efficient and Powerful Multilingual Translation Models in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22064","snapshot_observed_at":"2026-08-05T04:25:22.051935Z","title":"arXiv preprint arXiv:2605.22064 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:22.051935Z"},"links":{"cited_paper":"/paper/2605.22064","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:8022ef26f37e380e1a66c354a202cfd4629abc680bb07d2a38948407ede32d61","observation_id":"16b5eafb-a3c6-4380-9eeb-f8b58ece9b96","resolution":{"observed_at":"2026-08-05T04:25:22.051935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T00:21:03.167709Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":1,"unresolved":39,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2607.29397."}