{"as_of":"2026-08-19T19:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4918a483196a1fa3ca7ea86bd3bea7a6aa53e238b430dbcea16f0e73cf219208","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:12:57.564694Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:23:11.198439Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T20:23:11.602043Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"cited_work":{"arxiv_id":"1909.01792","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.01792","snapshot_observed_at":"2026-08-12T20:23:11.602043Z","title":"Mogrifier LSTM","venue":"cs.CL","work_id":"f36958f5-1d94-49da-9fbb-2fe645443bb3","year":2019},"citing_paper":{"arxiv_id":"2411.09827","last_updated":"2024-11-14T22:24:59Z","snapshot_observed_at":"2026-08-16T03:34:04.121174Z","submitted_at":"2024-11-14T22:24:59Z","title":"The Good, The Efficient and the Inductive Biases: Exploring Efficiency in Deep Learning Through the Use of Inductive Biases","version":1},"reference_index":260,"source":"pdf_text","source_observed_at":"2026-08-12T20:23:11.198439Z"},"links":{"cited_paper":"/paper/1909.01792","citing_paper":"/paper/2411.09827"},"observation_digest":"sha256:fe86285ba895bbb163c16563bb4f30e66057e69438a99fccb58ddffcc123a918","observation_id":"89dddcc9-dd31-459c-94f0-735eab16f8fb","resolution":{"observed_at":"2026-08-12T20:23:11.606561Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.01792/citation-record","integrity":"/paper/1909.01792/integrity","json":"/paper/1909.01792/citation-record.json","paper":"/paper/1909.01792"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.332300Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.332300Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:7bdda3f37e039aa118a5df0609a12d9569ca34257e25d0526ebfc9eecd03c77d","observation_id":"56910f27-38ea-4fe1-a4f0-5f7d83b7745d","resolution":{"observed_at":"2026-08-14T05:12:57.332300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.338086Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.338086Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:87a151f9ab4fe9e8bddf21721b6e219aa890886af108b5d5cea6ae40685d6679","observation_id":"479d92af-42d1-4b19-a777-43b4cd240191","resolution":{"observed_at":"2026-08-14T05:12:57.338086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.303865Z","title":null,"venue":null,"work_id":"3e25e9f6-e2b9-4f83-b424-3f1ca0cb7817","year":null},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.342443Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:2f32aaa1d105028f7dacf7c6d47fe09267497568e38d68e4022cd87f929407a9","observation_id":"63b21d39-0fc5-4c4c-bf11-65e515959866","resolution":{"observed_at":"2026-08-14T05:12:58.308453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07356","last_updated":"2016-09-27T19:56:22Z","snapshot_observed_at":"2026-08-14T21:51:26.440888Z","submitted_at":"2016-06-23T16:05:16Z","title":"Analyzing the Behavior of Visual Question Answering Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.07356","snapshot_observed_at":"2026-08-14T05:12:57.349356Z","title":"Analyzing the behavior of visual question answering models","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.349356Z"},"links":{"cited_paper":"/paper/1606.07356","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:0c7d0add00af86830057fdf1c4bf5651a84f86fc41d7a556656716f5a0517e67","observation_id":"173b16c2-6e86-4dad-9283-23aa39bb849e","resolution":{"observed_at":"2026-08-14T05:12:57.349356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.287427Z","title":"Unitary evolution recurrent neural networks","venue":null,"work_id":"b0fd90e6-522c-45a1-a9cd-e5eddea2296e","year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.354211Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:90ca0abedbece8c0943cc91c958f351a2e8b5cf77741b231b79e15e649be2257","observation_id":"75ea4f69-50ec-432e-bb10-1117dd0ed372","resolution":{"observed_at":"2026-08-14T05:12:58.294745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-18T12:17:42.484599Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-14T05:12:57.358728Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.358728Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:c79d3353ebe581d6fd39fe4b92e28029864f88d9ee87bd189be811ad11686bec","observation_id":"810a250e-39e6-4007-bec1-96597c26756b","resolution":{"observed_at":"2026-08-14T05:12:57.358728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.06682","last_updated":"2019-03-11T21:37:42Z","snapshot_observed_at":"2026-08-19T02:01:44.060061Z","submitted_at":"2018-10-15T20:50:05Z","title":"Trellis Networks for Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.06682","snapshot_observed_at":"2026-08-14T05:12:57.363148Z","title":"Trellis networks for sequence modeling","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.363148Z"},"links":{"cited_paper":"/paper/1810.06682","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:885d46513ebd96093135d2939bfe2bf4853c9b17ab4eb52fa44834d5216b8b96","observation_id":"fc7f6574-3967-4f3c-8ac6-782292f339eb","resolution":{"observed_at":"2026-08-14T05:12:57.363148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.272241Z","title":"Reinforcement learning with long short-term memory","venue":null,"work_id":"5b030bac-99a4-4071-bdd0-04c7141b3cb0","year":2002},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.367575Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:921dabb394e81b9ffc0b3b985f91a6ce22cf8d999cf25e2ec6538c7156f0ba34","observation_id":"87c61238-c7fb-4b6b-851f-b46268e0b64b","resolution":{"observed_at":"2026-08-14T05:12:58.277148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02173","last_updated":"2018-02-24T19:44:38Z","snapshot_observed_at":"2026-08-15T03:06:48.317810Z","submitted_at":"2017-11-06T20:59:58Z","title":"Synthetic and Natural Noise Both Break Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02173","snapshot_observed_at":"2026-08-14T05:12:57.372041Z","title":"Synthetic and natural noise both break neural machine translation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.372041Z"},"links":{"cited_paper":"/paper/1711.02173","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:8f5a79d22ef558c95f3c8b0c8b541b12f825882993268af48e23cca70e617445","observation_id":"4896386a-e21c-40a4-ba2d-a91c3e785ccd","resolution":{"observed_at":"2026-08-14T05:12:57.372041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.241279Z","title":"Gated feedback recurrent neural networks","venue":null,"work_id":"b314ca6c-2c48-4b1c-aebf-d2ff8371692c","year":2015},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.377040Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:cea883f80f770adca76ac8a7042d2ed6c54e95d998de8ac9d61bcc6d30e91b01","observation_id":"377b512a-a09c-40f5-94f5-c71eabab7015","resolution":{"observed_at":"2026-08-14T05:12:58.248443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02860","last_updated":"2019-06-02T21:21:48Z","snapshot_observed_at":"2026-08-16T17:45:52.864524Z","submitted_at":"2019-01-09T18:28:19Z","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02860","snapshot_observed_at":"2026-08-14T05:12:57.380842Z","title":"Transformer-xl: Attentive language models beyond a fixed-length context","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.380842Z"},"links":{"cited_paper":"/paper/1901.02860","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:2f9ada047fd65ab15f965e317c3b80ca59a03ae9e3409a25cfdf189eafb00d8f","observation_id":"8c7f0cd0-8bac-4faa-9293-aee5b48f874a","resolution":{"observed_at":"2026-08-14T05:12:57.380842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-14T05:12:57.385246Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.385246Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:d8bd2f2f5e2729ffb3055ca652e5629acee83a3f7d687eb2da9c9ad4199ba1ad","observation_id":"dabe9dc7-fac3-4303-9747-55c856fb4579","resolution":{"observed_at":"2026-08-14T05:12:57.385246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.389261Z","title":"Finding structure in time","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.389261Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:ba1ad8be6037908ff3f0382cb59006cc5fea36ae1e25c1564a0f3ba42d9e8e09","observation_id":"af817135-873a-4633-88ad-bdd23be7eecc","resolution":{"observed_at":"2026-08-14T05:12:57.389261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.214485Z","title":"Input switched affine networks: An rnn architecture designed for interpretability","venue":null,"work_id":"e3713a5e-bdf4-48ac-a3cc-f64f6dd43688","year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.393596Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:48b23a279d6dfdb093d97c8892d9733d90989d25120511e7adec2f8e209d0278","observation_id":"00833fd5-cabb-40aa-8855-4769367adbce","resolution":{"observed_at":"2026-08-14T05:12:58.219718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.194674Z","title":"A theoretically grounded application of dropout in recurrent neural networks","venue":null,"work_id":"ca4620bb-693f-4e55-bbe7-077835a65b6a","year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.398036Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:e12209329bdc807692e4ce5cd53a57150961f4969abc4bd462aaf9df696f83c5","observation_id":"dc9c1d08-cb2a-4fd1-afec-43b8444c6fce","resolution":{"observed_at":"2026-08-14T05:12:58.199294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.179152Z","title":"Google vizier: A service for black-box optimization","venue":null,"work_id":"6665875c-66ca-4f58-b981-0201d5990bd4","year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.401886Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:9adbbc7d15621ce95989ed21f7dc86a4c14e70d99a84fdcad5e1e33ed944d070","observation_id":"e42a85d8-f81c-4071-a61e-b6015ecef9ab","resolution":{"observed_at":"2026-08-14T05:12:58.185308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.162711Z","title":"Frage: frequency-agnostic word representation","venue":null,"work_id":"14bffe11-de77-4c2f-b070-81f352397d73","year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.405739Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:e5228e757566a0416becd3b2e4aeb892d2c0f094d875133e4b72ea432e4ecf99","observation_id":"1a891a88-029b-4f07-b940-7247c69649f6","resolution":{"observed_at":"2026-08-14T05:12:58.170063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.09106","last_updated":"2016-12-01T10:08:15Z","snapshot_observed_at":"2026-08-14T14:43:47.411225Z","submitted_at":"2016-09-27T05:57:00Z","title":"HyperNetworks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.09106","snapshot_observed_at":"2026-08-14T05:12:57.411023Z","title":"Hypernetworks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.411023Z"},"links":{"cited_paper":"/paper/1609.09106","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:d1bc026fde33877b0fa58ca7d4f8e04cf2e8036d1c0e23fd6d24197d858a7071","observation_id":"6cd858ef-7e1a-406a-b82a-d5ba9c8963f9","resolution":{"observed_at":"2026-08-14T05:12:57.411023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.145056Z","title":"Lstm can solve hard long time lag problems","venue":null,"work_id":"ddd58d01-fe8c-4608-908a-d075d8f21c50","year":1997},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.415006Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:481a863ff1bc7aab7de23d275474541e9d0e410378d91e5840676e7fb1cc3743","observation_id":"2fa64fc7-c5fd-4e16-ae7f-f23fa8dad20a","resolution":{"observed_at":"2026-08-14T05:12:58.150186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T05:12:57.418570Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.418570Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:51939a0686eafbe4423de231a5ed37f41cfc07416fb9977c07bae3807c4af2a0","observation_id":"1e4bf159-684a-4dd5-966d-172ba0f837e7","resolution":{"observed_at":"2026-08-14T05:12:57.418570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.127926Z","title":"The human knowledge compression contest","venue":null,"work_id":"57fcdacf-44dd-429e-b78b-e70413340f01","year":2012},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.422915Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:f39482d4e6da35420a9d1ef9f68fab390dfb1dbcdc0fbedc2ac000025c3b97e9","observation_id":"3b6c4d9c-fc1d-4537-bb2e-bb59d0bc46be","resolution":{"observed_at":"2026-08-14T05:12:58.132600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01462","last_updated":"2017-03-11T19:13:52Z","snapshot_observed_at":"2026-08-18T23:56:06.906645Z","submitted_at":"2016-11-04T17:36:20Z","title":"Tying Word Vectors and Word Classifiers: A Loss Framework for Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01462","snapshot_observed_at":"2026-08-14T05:12:57.426673Z","title":"Tying word vectors and word classifiers: A loss framework for language modeling","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.426673Z"},"links":{"cited_paper":"/paper/1611.01462","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:a5c9eda58cd6523a9494d29783a0126d676253fcc83a3bb32d2126e5b21a9bbd","observation_id":"fdcc7d51-b0f6-438f-acae-9922767cd081","resolution":{"observed_at":"2026-08-14T05:12:57.426673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06059","last_updated":"2018-04-17T06:12:36Z","snapshot_observed_at":"2026-08-19T05:48:40.560262Z","submitted_at":"2018-04-17T06:12:36Z","title":"Adversarial Example Generation with Syntactically Controlled Paraphrase Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06059","snapshot_observed_at":"2026-08-14T05:12:57.430517Z","title":"Adversarial example generation with syntactically controlled paraphrase networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.430517Z"},"links":{"cited_paper":"/paper/1804.06059","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:08ced4bac13b87ed94c926e9ac5f890963d97c24ddf424ae3ea57a253d437831","observation_id":"b9631206-c2ab-49f6-a068-0a83caec1149","resolution":{"observed_at":"2026-08-14T05:12:57.430517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.07328","last_updated":"2017-07-23T18:26:29Z","snapshot_observed_at":"2026-08-14T20:45:52.185644Z","submitted_at":"2017-07-23T18:26:29Z","title":"Adversarial Examples for Evaluating Reading Comprehension Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.07328","snapshot_observed_at":"2026-08-14T05:12:57.434371Z","title":"Adversarial examples for evaluating reading comprehension systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.434371Z"},"links":{"cited_paper":"/paper/1707.07328","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:600185c26a8347729429a069d2bb4ec8738c9a0ae5a1219139c805a7075ea89f","observation_id":"312ecaf0-2e3b-4990-8689-9c2bdcf9b417","resolution":{"observed_at":"2026-08-14T05:12:57.434371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.06986","last_updated":"2017-04-23T21:31:22Z","snapshot_observed_at":"2026-08-14T21:05:18.802484Z","submitted_at":"2017-04-23T21:31:22Z","title":"Learning to Create and Reuse Words in Open-Vocabulary Neural Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.06986","snapshot_observed_at":"2026-08-14T05:12:57.438320Z","title":"Learning to create and reuse words in open-vocabulary neural language modeling","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.438320Z"},"links":{"cited_paper":"/paper/1704.06986","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:e63b61d3cae23146341b06c971e77217b84d7516baf90c907b7799f07b20c322","observation_id":"9af3ee94-98dd-4432-936a-6852084de1fa","resolution":{"observed_at":"2026-08-14T05:12:57.438320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T05:12:57.442589Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.442589Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:e0f20e5aa518a2a49119175b3ed79d203f062d029477b5439d1691acbfc46b58","observation_id":"fe829cf4-c327-46e9-9b87-e1bf028fb767","resolution":{"observed_at":"2026-08-14T05:12:57.442589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07959","last_updated":"2017-10-12T17:05:47Z","snapshot_observed_at":"2026-08-14T21:38:10.810964Z","submitted_at":"2016-09-26T13:12:51Z","title":"Multiplicative LSTM for sequence modelling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07959","snapshot_observed_at":"2026-08-14T05:12:57.446357Z","title":"Multiplicative LSTM for sequence modelling","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.446357Z"},"links":{"cited_paper":"/paper/1609.07959","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:d20fd0e0b96a891a9deb64c74b796e7599a4566962c232fd391c9d12c40f9e0e","observation_id":"06c79d8a-dbbf-40e3-94f3-aa18bdf50edc","resolution":{"observed_at":"2026-08-14T05:12:57.446357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.07432","last_updated":"2017-10-25T22:31:34Z","snapshot_observed_at":"2026-08-14T20:30:55.525382Z","submitted_at":"2017-09-21T17:50:04Z","title":"Dynamic Evaluation of Neural Sequence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.07432","snapshot_observed_at":"2026-08-14T05:12:57.450132Z","title":"Dynamic evaluation of neural sequence models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.450132Z"},"links":{"cited_paper":"/paper/1709.07432","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:4611edebe0dc32f91ad00036eb2013c406a85927a94cf4fde75a5bd82a203407","observation_id":"8cd96dd2-d0dd-4e46-bac7-bd8564301bf4","resolution":{"observed_at":"2026-08-14T05:12:57.450132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08378","last_updated":"2019-04-17T17:26:01Z","snapshot_observed_at":"2026-08-15T13:56:36.823051Z","submitted_at":"2019-04-17T17:26:01Z","title":"Dynamic Evaluation of Transformer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08378","snapshot_observed_at":"2026-08-14T05:12:57.454691Z","title":"Dynamic evaluation of transformer language models","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.454691Z"},"links":{"cited_paper":"/paper/1904.08378","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:d42419d47172ed9d2917e348c7bb998cec4b92a631a777c3c79d193d80221ccf","observation_id":"a1ca4529-5d28-457f-8233-4de5b91d76e0","resolution":{"observed_at":"2026-08-14T05:12:57.454691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.107762Z","title":"Lstms can learn syntax-sensitive dependencies well, but modeling structure makes them better","venue":null,"work_id":"cc58767f-1cd4-49bc-b387-56c60d4bef51","year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.460041Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:43e92d103707298ed3c1799da76e5412ae308c0962ec37cfcca217f144a228b8","observation_id":"025bb797-e7cf-4263-8793-ffddc82a6ab6","resolution":{"observed_at":"2026-08-14T05:12:58.112418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.464436Z","title":"Assessing the ability of lstms to learn syntax-sensitive dependencies","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.464436Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:51211a4b11fe4c2ce5df1598c7db0cd55b8d2b404d231915fe5299449579647f","observation_id":"2f3db91c-e376-4959-a5cd-daf6cbaed75b","resolution":{"observed_at":"2026-08-14T05:12:57.464436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.083971Z","title":"Building a large annotated corpus of english: The Penn treebank","venue":null,"work_id":"dcfa45bd-04c4-4890-96bc-55196a87e09e","year":1993},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.469264Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:a86a52d0feaa955534dd25a3d931dce9160f43dd1cdb0936bc8f2f1f863b0253","observation_id":"2466d838-c18c-41b1-80b7-c2b16822d683","resolution":{"observed_at":"2026-08-14T05:12:58.089200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.068876Z","title":"A system for robotic heart surgery that learns to tie knots using recurrent neural networks","venue":null,"work_id":"8ae23f68-99d3-4296-8eb9-dcb82d35821c","year":2008},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.473294Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:ea5cb2102222a88b00c3e2fa6df6a8ea7c4958f1cbf4e021b03b385343a82e4a","observation_id":"db50dce1-2ed0-41c9-b8e8-ded7694c8018","resolution":{"observed_at":"2026-08-14T05:12:58.074119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05589","last_updated":"2017-11-20T17:57:58Z","snapshot_observed_at":"2026-08-14T23:27:22.902726Z","submitted_at":"2017-07-18T12:35:53Z","title":"On the State of the Art of Evaluation in Neural Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.05589","snapshot_observed_at":"2026-08-14T05:12:57.478351Z","title":"On the state of the art of evaluation in neural language models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.478351Z"},"links":{"cited_paper":"/paper/1707.05589","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:f3423f1cda5ef2ce57b3fe8f4513cf621e33a23f5563cf5e71457cf93e8f8217","observation_id":"b5ee142d-8e87-4d47-a06e-0ba1d4ad0666","resolution":{"observed_at":"2026-08-14T05:12:57.478351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09208","last_updated":"2018-09-27T15:19:20Z","snapshot_observed_at":"2026-08-14T19:11:59.636656Z","submitted_at":"2018-05-23T14:55:39Z","title":"Pushing the bounds of dropout","version":2},"cited_work":{"arxiv_id":"1805.09208","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.09208","snapshot_observed_at":"2026-08-14T05:12:57.736392Z","title":"Pushing the bounds of dropout","venue":"stat.ML","work_id":"f36ff3fb-bf52-4a74-8cf4-57a107bf31a0","year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.483472Z"},"links":{"cited_paper":"/paper/1805.09208","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:2a28ad1d54a9a0cba7da99ec6e97c3ecdb61d8f6e4ef5dacc94fb3414ba7e9d8","observation_id":"1d3bedba-bc37-4e66-9ce3-cc7d86365fa8","resolution":{"observed_at":"2026-08-14T05:12:57.740514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-14T05:12:57.490055Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.490055Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:9b9363069dd28c38448d8b4a7bc6a611bbb3aba62d83201ea02fa2650c496cec","observation_id":"45da7501-b9e8-428b-acf7-40bc091a2c26","resolution":{"observed_at":"2026-08-14T05:12:57.490055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02182","last_updated":"2017-08-07T16:03:44Z","snapshot_observed_at":"2026-08-18T19:06:52.997700Z","submitted_at":"2017-08-07T16:03:44Z","title":"Regularizing and Optimizing LSTM Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02182","snapshot_observed_at":"2026-08-14T05:12:57.494229Z","title":"Regularizing and optimizing lstm language models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.494229Z"},"links":{"cited_paper":"/paper/1708.02182","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:869d0e3dd19ebfc7afc65c1803e395d22c17c216d24f39616434b3d14027c0c7","observation_id":"dec9b438-3cf2-4b1e-a781-0c293bf14b59","resolution":{"observed_at":"2026-08-14T05:12:57.494229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08240","last_updated":"2018-03-22T06:25:47Z","snapshot_observed_at":"2026-08-19T00:54:49.973439Z","submitted_at":"2018-03-22T06:25:47Z","title":"An Analysis of Neural Language Modeling at Multiple Scales","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08240","snapshot_observed_at":"2026-08-14T05:12:57.498353Z","title":"An analysis of neural language modeling at multiple scales","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.498353Z"},"links":{"cited_paper":"/paper/1803.08240","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:51e1d11e0348177443089aeac9a02d4339ab3e640300ce6b18aaa6a33385c951","observation_id":"f23a0039-f384-4a69-a246-480b6c1f65af","resolution":{"observed_at":"2026-08-14T05:12:57.498353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.054700Z","title":"Recurrent neural network based language model","venue":null,"work_id":"eb9a5661-252a-41ac-be6d-d1a9d34d90d6","year":2010},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.502641Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:4f3c60ced13d5abfa28d17a8b23e41e81723eefa1271fc09edcc8bd6f16a2c08","observation_id":"8c11a50c-4355-4d09-8688-8ad9c36c3808","resolution":{"observed_at":"2026-08-14T05:12:58.059577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.06779","last_updated":"2017-04-22T09:59:42Z","snapshot_observed_at":"2026-08-18T19:51:54.737212Z","submitted_at":"2017-04-22T09:59:42Z","title":"Lexical Features in Coreference Resolution: To be Used With Caution","version":1},"cited_work":{"arxiv_id":"1704.06779","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.06779","snapshot_observed_at":"2026-08-14T05:12:57.677605Z","title":"Lexical Features in Coreference Resolution: To be Used With Caution","venue":"cs.CL","work_id":"d05f9b30-82b1-4879-a050-eafad82514fd","year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.507358Z"},"links":{"cited_paper":"/paper/1704.06779","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:c86c1072a0a2b96321d8c31edb0b96dc7aabb8fff4504e85009fe979a7de8995","observation_id":"b03a5855-d006-4690-871b-ba4d03cc1a58","resolution":{"observed_at":"2026-08-14T05:12:57.684547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.040064Z","title":"On the difficulty of training recurrent neural networks","venue":null,"work_id":"3bb5b70f-8882-45c3-82d9-336f94059039","year":2013},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.511588Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:622da09a8f74b749307477ce391d4b1f6361e60fdd887b6eadc9833070def332","observation_id":"c215e6d3-85bd-4454-8f31-247302af109f","resolution":{"observed_at":"2026-08-14T05:12:58.044734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05365","last_updated":"2018-03-22T21:59:40Z","snapshot_observed_at":"2026-08-14T19:45:43.957260Z","submitted_at":"2018-02-15T00:05:11Z","title":"Deep contextualized word representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05365","snapshot_observed_at":"2026-08-14T05:12:57.515997Z","title":"Deep contextualized word representations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.515997Z"},"links":{"cited_paper":"/paper/1802.05365","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:9456f8e5ddeb2693c506771409eee8a39cdda63eab78ebc31cdec0f0b3571ddf","observation_id":"7ac63eac-80f5-4e2e-a861-b68bde312d2f","resolution":{"observed_at":"2026-08-14T05:12:57.515997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.05859","last_updated":"2017-02-21T17:50:20Z","snapshot_observed_at":"2026-08-14T21:43:25.095281Z","submitted_at":"2016-08-20T18:32:05Z","title":"Using the Output Embedding to Improve Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.05859","snapshot_observed_at":"2026-08-14T05:12:57.520799Z","title":"Using the output embedding to improve language models","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.520799Z"},"links":{"cited_paper":"/paper/1608.05859","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:c18ab574b157eb69b198128e935ea71750117563d3b43eaf2f4ab8be707ff5f8","observation_id":"91723b19-634f-4a41-8701-3b06253c0583","resolution":{"observed_at":"2026-08-14T05:12:57.520799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.024748Z","title":"Learning representations by back-propagating errors","venue":null,"work_id":"05fdcbbb-9c5a-4e2e-9197-0469689de260","year":1988},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.525377Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:bb36b78b765957073e0f7bb551ab05cfc71d146dd9129e0a1dacced3db1af7fb","observation_id":"df8c45ea-68cd-44be-93d0-93601b0f121b","resolution":{"observed_at":"2026-08-14T05:12:58.029740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1402.1128","last_updated":"2014-02-05T19:01:51Z","snapshot_observed_at":"2026-08-17T13:26:41.306451Z","submitted_at":"2014-02-05T19:01:51Z","title":"Long Short-Term Memory Based Recurrent Neural Network Architectures for Large Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1402.1128","snapshot_observed_at":"2026-08-14T05:12:57.529055Z","title":"Senior, and Fran c oise Beaufays","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.529055Z"},"links":{"cited_paper":"/paper/1402.1128","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:028c5118f2309e85a68867bf35a2a99bdfe9f8fd5cf5b9d617c03b11bb7050a1","observation_id":"6cc8bc61-8988-4a66-8544-02f5381982ef","resolution":{"observed_at":"2026-08-14T05:12:57.529055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.07909","last_updated":"2016-06-10T14:45:08Z","snapshot_observed_at":"2026-08-17T07:28:37.146698Z","submitted_at":"2015-08-31T16:37:31Z","title":"Neural Machine Translation of Rare Words with Subword Units","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.07909","snapshot_observed_at":"2026-08-14T05:12:57.533188Z","title":"Neural machine translation of rare words with subword units","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.533188Z"},"links":{"cited_paper":"/paper/1508.07909","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:02ffeef63534f5f8b73a95904819091512cfb03def508915fa8efc43831f5364","observation_id":"fd4d17b1-a287-4c8c-8c3c-e8729a81d150","resolution":{"observed_at":"2026-08-14T05:12:57.533188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:58.011466Z","title":"Generating text with recurrent neural networks","venue":null,"work_id":"424aede3-ea7d-4f86-a54d-93bd6b913578","year":2011},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.538099Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:422e8a9053bfe7ae41f4ef6bbd830f9304ec842beb6034c2078f0a6ffad724f1","observation_id":"6cb2a259-a774-4430-b9c7-ddb8e86978e3","resolution":{"observed_at":"2026-08-14T05:12:58.015614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.998329Z","title":"Sequence to sequence learning with neural networks","venue":null,"work_id":"87cc6352-6a02-40a1-83fd-56a4dcc4fdd7","year":2014},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.542250Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:4bffdde2ae2f6b9d7ee94d76752cd2df15f17c33c528ead1753c9b5e466fe0cc","observation_id":"578d08a2-841e-4763-89c2-f2090eab743c","resolution":{"observed_at":"2026-08-14T05:12:58.002689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.985894Z","title":"Sequence modeling via segmentations","venue":null,"work_id":"b8e266e4-db2b-4324-8a7f-59e7ce550bf4","year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.547242Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:47083f685fe93bfaf2b699978ea574a9eb342548fd77d6183fe091d662dd1d66","observation_id":"0c465eeb-6049-41b4-a40f-f45f26669564","resolution":{"observed_at":"2026-08-14T05:12:57.989880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.972255Z","title":"Backpropagation through time: what it does and how to do it","venue":null,"work_id":"3415a659-67cf-40ee-a6a9-fb79b49d418d","year":1990},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.552053Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:b83f4388ff542f4cbdecb042a305e96c58ecae2e53e711e0ebae782fb8fc93a1","observation_id":"0d92f811-154b-4736-99d6-c217e77f1659","resolution":{"observed_at":"2026-08-14T05:12:57.976881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:12:57.957478Z","title":"On multiplicative integration with recurrent neural networks","venue":null,"work_id":"a7a5a957-2c63-4d02-a9d7-4018eb0ab8d6","year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.556477Z"},"links":{"citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:47c3db26c34e3dd5e288d63a505351fe67862f221a02217302dab1b0894905a1","observation_id":"747ca621-21a9-4922-9b82-9cda157e9566","resolution":{"observed_at":"2026-08-14T05:12:57.963009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.03953","last_updated":"2018-03-02T20:20:52Z","snapshot_observed_at":"2026-08-14T20:14:49.577343Z","submitted_at":"2017-11-10T18:29:00Z","title":"Breaking the Softmax Bottleneck: A High-Rank RNN Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.03953","snapshot_observed_at":"2026-08-14T05:12:57.560482Z","title":"Breaking the softmax bottleneck: a high-rank rnn language model","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.560482Z"},"links":{"cited_paper":"/paper/1711.03953","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:c8fc8310d9bfd5cad7ef6c7a4ebb469d4a9c2221ba0242572123aeb0b26b256b","observation_id":"f59c2440-ecb4-4a1a-be01-838305f34a9f","resolution":{"observed_at":"2026-08-14T05:12:57.560482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01578","last_updated":"2017-02-15T05:28:05Z","snapshot_observed_at":"2026-08-14T21:31:52.294004Z","submitted_at":"2016-11-05T00:41:37Z","title":"Neural Architecture Search with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01578","snapshot_observed_at":"2026-08-14T05:12:57.564694Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.564694Z"},"links":{"cited_paper":"/paper/1611.01578","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:4849926ca0ff68b09f9dfc23754df9f4f4f948b7f2326c549b344d89c5495b71","observation_id":"b25490e6-8242-4751-8cab-eddcb3d8219b","resolution":{"observed_at":"2026-08-14T05:12:57.564694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":20},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:1909.01792."}