Pith. sign in

Paper Citation Record · LEDGER

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation

As of 17 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:1909.00562.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
1909.00562 v2

Coverage vector

measured 23 of 23 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-14T05:53:18.727309Z

measured 24 of 24 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T05:21:33.416076Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-10T05:30:23.456663Z

Reference resolution

23 of 23 outbound references displayed

  • verified exact1
  • verified fuzzy3
  • unresolved19
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

4
pith, observed 2026-08-10T05:30:23.456663Z

Outbound references

Observation 95d11ec7-c77d-4d60-9203-2c7ee472211c · outbound

This paper cites Murray, Benoit Steiner, Paul Tucker, Vijay Vasudevan, Pete Warden, Martin Wicke, Yuan Yu, and Xiaoqiang Zheng.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Murray, Benoit Steiner, Paul Tucker, Vijay Vasudevan, Pete Warden, Martin Wicke, Yuan Yu, and Xiaoqiang Zheng

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-14T05:53:19.160824Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.605401Z digest=sha256:f1fbc42815f915d8880e4a65ac755331b0b0d1e91ef106e38916488d308421c6

Observation 5bc17881-c7e1-4748-a3da-da1b67f10a5f · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.143442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.611431Z digest=sha256:38ff448c944fcd683e7e13e40d4ce7b20c4ebbc595e009bf0b92a2362c841e40

Observation 3a75cee5-5a6d-4a89-bbed-e5e284c432e7 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.127939Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.617896Z digest=sha256:6b35a062e337547e7af06ec2f297c2ca79375245da0527ccac2acd4908d13af5

Observation db900bfa-7d45-4ab1-b920-a85b9f48606a · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.112385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.622906Z digest=sha256:2c1668a469accf9c2e5448dc9537b108fc18e9ce2a9c0d25129e26c0140c140e

Observation 7831a4c8-6df8-49b1-bd01-c28fc70e272a · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.096136Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.628387Z digest=sha256:6aa5d450522f8c6b91e243b8328b2e9ea9ca2a91cbe1530c76ff906ff51d4b58

Observation 5096e2d8-473b-4c0b-b5a9-26356ed41a55 · outbound

This paper cites MXNet: A Flexible and Efficient Machine Learning Library for Heterogeneous Distributed Systems.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation MXNet: A Flexible and Efficient Machine Learning Library for Heterogeneous Distributed Systems

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.633580Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.633580Z digest=sha256:8af88c75d4bc6da7edeabda579013cc76794261ee73355314646ce061fae6754

Observation 2e91ec69-015f-4a9f-a65a-e52aeb6f0b89 · outbound

This paper cites A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.639813Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.639813Z digest=sha256:7434f49b023fb3d54ff427ca13f8880b95bebad25445dfe7b1f271dccfb71d91

Observation 1d21743d-b48a-43f7-8ce0-f7675ebb3191 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.079187Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.646065Z digest=sha256:b4379e94d3a7a8493af6c785e4705101e0579ceb946ce5f8d0f5038c642ec8d9

Observation 7df3a9de-e9a9-4740-a10e-0492b112abe8 · outbound

This paper cites Marian: Fast Neural Machine Translation in C++.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Marian: Fast Neural Machine Translation in C++

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.651328Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.651328Z digest=sha256:9ee5b0aaed5d4119dbafd982fbde4cb8199eaf9629667261c3425dbb8473d294

Observation 22b68624-80b9-429d-8358-b3eb4dace6c4 · outbound

This paper cites On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.658441Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.658441Z digest=sha256:1d7d0147b010fcbb46aff1348885fb599dd6cc0380e5cee0c3d6159b03a7282b

Observation d7dbcc3c-98c1-459f-bec1-6447c0a6323d · outbound

This paper cites Kingma and Jimmy Ba.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Kingma and Jimmy Ba

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-14T05:53:19.062949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.663741Z digest=sha256:d2158635c3d300e1aa281165a6ac4c0130a34c6df5c0af05abe39ae45e956f0b

Observation 8a9b3080-2414-42c3-8588-5e738225f787 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.045302Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.670250Z digest=sha256:2628eab7daae003c6e137ac820bb724b990728650981c5a1706ffa289331bf12

Observation fb3bda1f-cb99-4f1a-bed3-a235a53c237b · outbound

This paper cites One weird trick for parallelizing convolutional neural networks.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation One weird trick for parallelizing convolutional neural networks

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.675029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.675029Z digest=sha256:9309cbbb1f10d0977bdc2d845d1986b6c8e3d7f9d8ffc125442f93cececa9770

Observation 7084d467-618d-4aba-84cc-e6b55302d051 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.027717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.680372Z digest=sha256:50be47fac18b609757714646c59e0028eac42fa2cea741844ce3080f82f0a117

Observation 46f69aaf-8a22-4c7f-8d17-64f028a37481 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.005899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.685613Z digest=sha256:d38f00fb3908ba4869285a3429b8d684d25bdf36a93cb0896853488710333029

Observation efb50027-613c-4248-b9a1-c6d6fd2bb01c · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.988212Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.691173Z digest=sha256:c66ec93da1e279bacd63afafebeabe4d40dc845aaef091f55179f3ecf951b4c9

Observation b7c5e7f0-fe09-4d49-a9c4-2eccce435d5b · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.968424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.696481Z digest=sha256:1e8ec5d69731291ec24b5fb83dd8030f226c7afc4129e369712174bfc2cf448b

Observation 3052b6d8-8f6c-44d3-a62c-3c8d5288191a · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.951209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.701822Z digest=sha256:72fb68e50aa00262d384ffc63a94c118f17f2c72e30bbede977806e1767c2f92

Observation f74c479a-2397-4f84-a746-c8d4d3a7dc9d · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.932480Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.706952Z digest=sha256:d0d124ebf7a8175dead48d56e485b4ab0ed18af6f2d18fde737552288afcffd0

Observation 28b38436-898b-4b71-90c8-2b10dbf62cda · outbound

This paper cites Gomez, ukasz Kaiser, and Illia Polosukhin.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Gomez, ukasz Kaiser, and Illia Polosukhin

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-14T05:53:18.915368Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.711767Z digest=sha256:973f550f0fa13002a517693cb35e5710098b706c1987371d24b0db67365d8c57

Observation b520807d-98d4-4625-8517-427fcd95a6f8 · outbound

This paper cites Unifying Data, Model and Hybrid Parallelism in Deep Learning via Tensor Tiling.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unifying Data, Model and Hybrid Parallelism in Deep Learning via Tensor Tiling

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-08-14T05:53:18.796890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.716985Z digest=sha256:109d7d864feef201676b92698c59d2fde6f95eea21041231973d850cd5792a07

Observation 55b28722-890b-4bf6-9c31-ca435ed41a7f · outbound

This paper cites Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.722051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.722051Z digest=sha256:3b25195366f4a58abd7e5c1c134d2a6a61f67ded9ffe25e571a72f7163b6105a

Observation 478c27fd-705f-4332-aad4-cf6ee68af3ea · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.899202Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.727309Z digest=sha256:c5c06d3aaebae8ed820c8f429cda07ba760d593d726ef56ae2748202afa4f1f8

Pith citing papers

Observation 8332ef49-80b5-4f9f-bad0-461154ebc150 · inbound

Distributed Deep Learning using Stochastic Gradient Staleness cites this paper.

Distributed Deep Learning using Stochastic Gradient Staleness Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-08-05T05:21:33.456547Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-05T05:21:33.416076Z digest=sha256:f82f13d1b6484eefc96dcf021173ca792b8e3dd937a3dfa7962d343e5e4fc042