{"as_of":"2026-08-22T03:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cb723eb909e8cd7fb55f9658cfd2cca59b3880b16444648c55e4b47a2c22f3b","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:53:18.727309Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:21:33.416076Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":4,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"cited_work":{"arxiv_id":"1909.00562","doi":"10.48550/arxiv.1909.00562","metadata_source":"pith","pith_arxiv_id":"1909.00562","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","venue":"cs.DC","work_id":"ba5b03de-9599-4783-b1fb-de2ba0a5e63f","year":2019},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-21T23:01:39.307683Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.416076Z"},"links":{"cited_paper":"/paper/1909.00562","citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:65bc2bda56dcbb6351382080d6bdf20d46ddebe6f41eff8028551ea492b8b1cb","observation_id":"8332ef49-80b5-4f9f-bad0-461154ebc150","resolution":{"observed_at":"2026-08-05T05:21:33.456547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.00562/citation-record","integrity":"/paper/1909.00562/integrity","json":"/paper/1909.00562/citation-record.json","paper":"/paper/1909.00562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.155265Z","title":"Murray, Benoit Steiner, Paul Tucker, Vijay Vasudevan, Pete Warden, Martin Wicke, Yuan Yu, and Xiaoqiang Zheng","venue":null,"work_id":"ed52a423-4be9-4246-9e2e-736d63732b7f","year":2016},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.605401Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:ea9176020b59881162d67c9dc92ea1eedb7865ee832a7a9fba7be4ffedc2411a","observation_id":"95d11ec7-c77d-4d60-9203-2c7ee472211c","resolution":{"observed_at":"2026-08-14T05:53:19.160824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.138727Z","title":null,"venue":null,"work_id":"c91947b3-1e2b-435d-ad1e-83a29a88b9cd","year":2015},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.611431Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:a7e4eb22ea9a7473cc9966c2f9bf5cacf3bce2e45a389a58e40370a22811d752","observation_id":"5bc17881-c7e1-4748-a3da-da1b67f10a5f","resolution":{"observed_at":"2026-08-14T05:53:19.143442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.123102Z","title":null,"venue":null,"work_id":"0feadabe-3977-4ca7-bf9c-d7375ce4d7b0","year":2014},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.617896Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:bbadb4d88ff9499501968657ccc2779596b87141408aee856aa53820fcaf4fba","observation_id":"3a75cee5-5a6d-4a89-bbed-e5e284c432e7","resolution":{"observed_at":"2026-08-14T05:53:19.127939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.107371Z","title":null,"venue":null,"work_id":"499fefce-27ba-4221-86ef-9b2827ec3dd2","year":2017},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.622906Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:ce59a6592f456a04c57106868ac56006194e8668734ccf3c0ab74a268f166db8","observation_id":"db900bfa-7d45-4ab1-b920-a85b9f48606a","resolution":{"observed_at":"2026-08-14T05:53:19.112385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.091095Z","title":null,"venue":null,"work_id":"526cccd5-7fed-46da-ba76-5c46a658af67","year":2017},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.628387Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:bd4fd4d0c33e2d9021162c4fcd81207852e05339e851f6c84dcbb752f5dde2bc","observation_id":"7831a4c8-6df8-49b1-bd01-c28fc70e272a","resolution":{"observed_at":"2026-08-14T05:53:19.096136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.01274","last_updated":"2015-12-03T22:49:21Z","snapshot_observed_at":"2026-08-18T16:08:31.988059Z","submitted_at":"2015-12-03T22:49:21Z","title":"MXNet: A Flexible and Efficient Machine Learning Library for Heterogeneous Distributed Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.01274","snapshot_observed_at":"2026-08-14T05:53:18.633580Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.633580Z"},"links":{"cited_paper":"/paper/1512.01274","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:2f11990c6900c361fa4dd646c2129f58d3729516833be06bdb7df5dc251cdbae","observation_id":"5096e2d8-473b-4c0b-b5a9-26356ed41a55","resolution":{"observed_at":"2026-08-14T05:53:18.633580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.06147","last_updated":"2016-06-21T01:12:22Z","snapshot_observed_at":"2026-08-17T01:30:06.663137Z","submitted_at":"2016-03-19T21:35:04Z","title":"A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.06147","snapshot_observed_at":"2026-08-14T05:53:18.639813Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.639813Z"},"links":{"cited_paper":"/paper/1603.06147","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:6504cb2bf947ec9aaacffc3be788b5337ffad0c4cb3facaabb5d7fd25efda3a0","observation_id":"2e91ec69-015f-4a9f-a65a-e52aeb6f0b89","resolution":{"observed_at":"2026-08-14T05:53:18.639813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.073836Z","title":null,"venue":null,"work_id":"128baf4c-5cea-47b1-8510-624a1a9cd70c","year":2015},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.646065Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:ff0f8f2f3a221e9b9ffddf71e049b679615c1b83c6c014615ed5ecf58e15219f","observation_id":"1d21743d-b48a-43f7-8ce0-f7675ebb3191","resolution":{"observed_at":"2026-08-14T05:53:19.079187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.00344","last_updated":"2018-04-04T15:34:17Z","snapshot_observed_at":"2026-08-14T19:30:16.995503Z","submitted_at":"2018-04-01T20:50:57Z","title":"Marian: Fast Neural Machine Translation in C++","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.00344","snapshot_observed_at":"2026-08-14T05:53:18.651328Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.651328Z"},"links":{"cited_paper":"/paper/1804.00344","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:11d0174ac428077d2b17368a7b6def5001da0e132b8b0a59f1bdcc9313cb370b","observation_id":"7df3a9de-e9a9-4740-a10e-0492b112abe8","resolution":{"observed_at":"2026-08-14T05:53:18.651328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-08-15T20:45:29.277746Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04836","snapshot_observed_at":"2026-08-14T05:53:18.658441Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.658441Z"},"links":{"cited_paper":"/paper/1609.04836","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:c2f321da4d9c8e1b56556f666c0f52d665e3e885deedb37d105af448f2768e39","observation_id":"22b68624-80b9-429d-8358-b3eb4dace6c4","resolution":{"observed_at":"2026-08-14T05:53:18.658441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.057823Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"95cf9ad6-c7f6-4d28-a957-c940d0fea7f3","year":2015},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.663741Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:443e1e4f9e72ba41ed9781b6d8115594143aa17a6472d5a9412af3d73dde4da3","observation_id":"d7dbcc3c-98c1-459f-bec1-6447c0a6323d","resolution":{"observed_at":"2026-08-14T05:53:19.062949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.039227Z","title":null,"venue":null,"work_id":"8c72a31e-6417-404d-befa-dbe841dc35e7","year":2017},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.670250Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:ecd99bf1f0d7555311b406c1d63006840bfda282c31d6347fcdacf3f4cf244bd","observation_id":"8a9b3080-2414-42c3-8588-5e738225f787","resolution":{"observed_at":"2026-08-14T05:53:19.045302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1404.5997","last_updated":"2014-04-26T23:10:51Z","snapshot_observed_at":"2026-08-14T23:36:31.652827Z","submitted_at":"2014-04-23T22:37:56Z","title":"One weird trick for parallelizing convolutional neural networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1404.5997","snapshot_observed_at":"2026-08-14T05:53:18.675029Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.675029Z"},"links":{"cited_paper":"/paper/1404.5997","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:7bed8db9141f5b0bdfa7470f2bf0a5d8cd8a0c0e6bf49fe9bcfc4c84ad766ebf","observation_id":"fb3bda1f-cb99-4f1a-bed3-a235a53c237b","resolution":{"observed_at":"2026-08-14T05:53:18.675029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.022218Z","title":null,"venue":null,"work_id":"2ceed5a2-ee04-4c6f-a77f-084d40207059","year":2015},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.680372Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:6f526953b0b5496acace157677157ef29f79ab44aa44c3c7cb3c2e988e1d4f3e","observation_id":"7084d467-618d-4aba-84cc-e6b55302d051","resolution":{"observed_at":"2026-08-14T05:53:19.027717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:19.000222Z","title":null,"venue":null,"work_id":"becd029f-b49b-42a8-abf6-8f386ea6cbff","year":2018},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.685613Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:59fd61c2b72ffef91589e8e6c3b8951f0c9e458cbd900127f99d8efce42fdf32","observation_id":"46f69aaf-8a22-4c7f-8d17-64f028a37481","resolution":{"observed_at":"2026-08-14T05:53:19.005899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:18.981942Z","title":null,"venue":null,"work_id":"632fc852-77f9-434d-a862-f640f3aa5562","year":2017},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.691173Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:1587442fd998bee2a6cd7a63b8ab575838e3b4e9d110b5838ef68d3c5fe31daf","observation_id":"efb50027-613c-4248-b9a1-c6d6fd2bb01c","resolution":{"observed_at":"2026-08-14T05:53:18.988212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:18.963297Z","title":null,"venue":null,"work_id":"b865d991-ab09-4ca5-9372-3885efdf2328","year":2016},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.696481Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:feea40999f0582eba03186341497c76b8a95d9be8ff3c362783560e265425862","observation_id":"b7c5e7f0-fe09-4d49-a9c4-2eccce435d5b","resolution":{"observed_at":"2026-08-14T05:53:18.968424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:18.945937Z","title":null,"venue":null,"work_id":"fc8f4903-313c-4a13-9024-e8269cab216b","year":2016},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.701822Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:a1db8a002ed4e0264d9c64d841aea328bc373bb03ed0a173a427f9723c76730e","observation_id":"3052b6d8-8f6c-44d3-a62c-3c8d5288191a","resolution":{"observed_at":"2026-08-14T05:53:18.951209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:18.927212Z","title":null,"venue":null,"work_id":"f02ff39b-ee48-47ab-a567-f455c3ed58fb","year":2014},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.706952Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:6c77c8ed970dbf3badee527aefe8c33f12fb72c28577da932a0eb79d3ba13c80","observation_id":"f74c479a-2397-4f84-a746-c8d4d3a7dc9d","resolution":{"observed_at":"2026-08-14T05:53:18.932480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:18.910367Z","title":"Gomez, ukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"77b41eca-1eea-4a62-a8aa-e4c21670110c","year":2017},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.711767Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:481306cb96289c311f66200d85d7ecd16092daff870f0a32732dd954307b6748","observation_id":"28b38436-898b-4b71-90c8-2b10dbf62cda","resolution":{"observed_at":"2026-08-14T05:53:18.915368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04170","last_updated":"2018-05-10T20:38:56Z","snapshot_observed_at":"2026-08-17T20:28:30.660673Z","submitted_at":"2018-05-10T20:38:56Z","title":"Unifying Data, Model and Hybrid Parallelism in Deep Learning via Tensor Tiling","version":1},"cited_work":{"arxiv_id":"1805.04170","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.04170","snapshot_observed_at":"2026-08-14T05:53:18.787594Z","title":"Unifying Data, Model and Hybrid Parallelism in Deep Learning via Tensor Tiling","venue":"cs.DC","work_id":"6161dbcf-75a5-414c-9650-b066c0ee77fe","year":2018},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.716985Z"},"links":{"cited_paper":"/paper/1805.04170","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:fd74095a562bbfa76b07e078b00e65d6fea5b5e004e41ec8773428967f704d06","observation_id":"b520807d-98d4-4625-8517-427fcd95a6f8","resolution":{"observed_at":"2026-08-14T05:53:18.796890Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-14T05:53:18.722051Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.722051Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:e656161f400608010c18c281d153c487af09802a63d0d6308eeeea28e53579d3","observation_id":"55b28722-890b-4bf6-9c31-ca435ed41a7f","resolution":{"observed_at":"2026-08-14T05:53:18.722051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:53:18.894415Z","title":null,"venue":null,"work_id":"0b323495-0315-4732-ae02-b66c187c97b2","year":2016},"citing_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T05:53:18.727309Z"},"links":{"citing_paper":"/paper/1909.00562"},"observation_digest":"sha256:7bedd8a71c71faf9435a17ddd4d6a8bd979229d078059eb5c417842f2293e66c","observation_id":"478c27fd-705f-4332-aad4-cf6ee68af3ea","resolution":{"observed_at":"2026-08-14T05:53:18.899202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-20T15:55:18.344342Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:1909.00562."}