Pith. sign in

Paper Citation Record · LEDGER

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation

As of 21 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:1909.00562.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
1909.00562 v2

Coverage vector

measured 23 of 23 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-14T05:53:18.727309Z

measured 24 of 24 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T05:21:33.416076Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-10T05:30:23.456663Z

Reference resolution

23 of 23 outbound references displayed

  • verified exact1
  • verified fuzzy3
  • unresolved19
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

4
pith, observed 2026-08-10T05:30:23.456663Z

Outbound references

Observation 95d11ec7-c77d-4d60-9203-2c7ee472211c · outbound

This paper cites Murray, Benoit Steiner, Paul Tucker, Vijay Vasudevan, Pete Warden, Martin Wicke, Yuan Yu, and Xiaoqiang Zheng.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Murray, Benoit Steiner, Paul Tucker, Vijay Vasudevan, Pete Warden, Martin Wicke, Yuan Yu, and Xiaoqiang Zheng

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-14T05:53:19.160824Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.605401Z digest=sha256:ea9176020b59881162d67c9dc92ea1eedb7865ee832a7a9fba7be4ffedc2411a

Observation 5bc17881-c7e1-4748-a3da-da1b67f10a5f · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.143442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.611431Z digest=sha256:a7e4eb22ea9a7473cc9966c2f9bf5cacf3bce2e45a389a58e40370a22811d752

Observation 3a75cee5-5a6d-4a89-bbed-e5e284c432e7 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.127939Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.617896Z digest=sha256:bbadb4d88ff9499501968657ccc2779596b87141408aee856aa53820fcaf4fba

Observation db900bfa-7d45-4ab1-b920-a85b9f48606a · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.112385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.622906Z digest=sha256:ce59a6592f456a04c57106868ac56006194e8668734ccf3c0ab74a268f166db8

Observation 7831a4c8-6df8-49b1-bd01-c28fc70e272a · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.096136Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.628387Z digest=sha256:bd4fd4d0c33e2d9021162c4fcd81207852e05339e851f6c84dcbb752f5dde2bc

Observation 5096e2d8-473b-4c0b-b5a9-26356ed41a55 · outbound

This paper cites MXNet: A Flexible and Efficient Machine Learning Library for Heterogeneous Distributed Systems.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation MXNet: A Flexible and Efficient Machine Learning Library for Heterogeneous Distributed Systems

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.633580Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.633580Z digest=sha256:2f11990c6900c361fa4dd646c2129f58d3729516833be06bdb7df5dc251cdbae

Observation 2e91ec69-015f-4a9f-a65a-e52aeb6f0b89 · outbound

This paper cites A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.639813Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.639813Z digest=sha256:6504cb2bf947ec9aaacffc3be788b5337ffad0c4cb3facaabb5d7fd25efda3a0

Observation 1d21743d-b48a-43f7-8ce0-f7675ebb3191 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.079187Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.646065Z digest=sha256:ff0f8f2f3a221e9b9ffddf71e049b679615c1b83c6c014615ed5ecf58e15219f

Observation 7df3a9de-e9a9-4740-a10e-0492b112abe8 · outbound

This paper cites Marian: Fast Neural Machine Translation in C++.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Marian: Fast Neural Machine Translation in C++

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.651328Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.651328Z digest=sha256:11d0174ac428077d2b17368a7b6def5001da0e132b8b0a59f1bdcc9313cb370b

Observation 22b68624-80b9-429d-8358-b3eb4dace6c4 · outbound

This paper cites On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.658441Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.658441Z digest=sha256:c2f321da4d9c8e1b56556f666c0f52d665e3e885deedb37d105af448f2768e39

Observation d7dbcc3c-98c1-459f-bec1-6447c0a6323d · outbound

This paper cites Kingma and Jimmy Ba.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Kingma and Jimmy Ba

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-14T05:53:19.062949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.663741Z digest=sha256:443e1e4f9e72ba41ed9781b6d8115594143aa17a6472d5a9412af3d73dde4da3

Observation 8a9b3080-2414-42c3-8588-5e738225f787 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.045302Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.670250Z digest=sha256:ecd99bf1f0d7555311b406c1d63006840bfda282c31d6347fcdacf3f4cf244bd

Observation fb3bda1f-cb99-4f1a-bed3-a235a53c237b · outbound

This paper cites One weird trick for parallelizing convolutional neural networks.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation One weird trick for parallelizing convolutional neural networks

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.675029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.675029Z digest=sha256:7bed8db9141f5b0bdfa7470f2bf0a5d8cd8a0c0e6bf49fe9bcfc4c84ad766ebf

Observation 7084d467-618d-4aba-84cc-e6b55302d051 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.027717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.680372Z digest=sha256:6f526953b0b5496acace157677157ef29f79ab44aa44c3c7cb3c2e988e1d4f3e

Observation 46f69aaf-8a22-4c7f-8d17-64f028a37481 · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:19.005899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.685613Z digest=sha256:59fd61c2b72ffef91589e8e6c3b8951f0c9e458cbd900127f99d8efce42fdf32

Observation efb50027-613c-4248-b9a1-c6d6fd2bb01c · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.988212Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.691173Z digest=sha256:1587442fd998bee2a6cd7a63b8ab575838e3b4e9d110b5838ef68d3c5fe31daf

Observation b7c5e7f0-fe09-4d49-a9c4-2eccce435d5b · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.968424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.696481Z digest=sha256:feea40999f0582eba03186341497c76b8a95d9be8ff3c362783560e265425862

Observation 3052b6d8-8f6c-44d3-a62c-3c8d5288191a · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.951209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.701822Z digest=sha256:a1db8a002ed4e0264d9c64d841aea328bc373bb03ed0a173a427f9723c76730e

Observation f74c479a-2397-4f84-a746-c8d4d3a7dc9d · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.932480Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.706952Z digest=sha256:6c77c8ed970dbf3badee527aefe8c33f12fb72c28577da932a0eb79d3ba13c80

Observation 28b38436-898b-4b71-90c8-2b10dbf62cda · outbound

This paper cites Gomez, ukasz Kaiser, and Illia Polosukhin.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Gomez, ukasz Kaiser, and Illia Polosukhin

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-14T05:53:18.915368Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.711767Z digest=sha256:481306cb96289c311f66200d85d7ecd16092daff870f0a32732dd954307b6748

Observation b520807d-98d4-4625-8517-427fcd95a6f8 · outbound

This paper cites Unifying Data, Model and Hybrid Parallelism in Deep Learning via Tensor Tiling.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unifying Data, Model and Hybrid Parallelism in Deep Learning via Tensor Tiling

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-08-14T05:53:18.796890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.716985Z digest=sha256:fd74095a562bbfa76b07e078b00e65d6fea5b5e004e41ec8773428967f704d06

Observation 55b28722-890b-4bf6-9c31-ca435ed41a7f · outbound

This paper cites Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-14T05:53:18.722051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T05:53:18.722051Z digest=sha256:e656161f400608010c18c281d153c487af09802a63d0d6308eeeea28e53579d3

Observation 478c27fd-705f-4332-aad4-cf6ee68af3ea · outbound

This paper cites an unresolved cited work.

Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-14T05:53:18.899202Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-14T05:53:18.727309Z digest=sha256:7bedd8a71c71faf9435a17ddd4d6a8bd979229d078059eb5c417842f2293e66c

Pith citing papers

Observation 8332ef49-80b5-4f9f-bad0-461154ebc150 · inbound

Distributed Deep Learning using Stochastic Gradient Staleness cites this paper.

Distributed Deep Learning using Stochastic Gradient Staleness Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-08-05T05:21:33.456547Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-05T05:21:33.416076Z digest=sha256:5df023b38e9080c7e308b9aba436fd09a8ac6603d95414b67b4185ea15bb74ca