{"as_of":"2026-08-12T07:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a411aa2d1b81448c2d65ad53cd212859479a315e2a03f533a6dbe822c299c928","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:10:24.585381Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.16188/citation-record","integrity":"/paper/2412.16188/integrity","json":"/paper/2412.16188/citation-record.json","paper":"/paper/2412.16188"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T16:10:24.331409Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.331409Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:ab18156917cbea4401189c59db9e91d99d4ccdaa62e94b894f4fc545bbe8760a","observation_id":"0a4915d1-bfa5-4903-9725-387a4c81a14c","resolution":{"observed_at":"2026-08-11T16:10:24.331409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01261","last_updated":"2018-10-17T17:51:36Z","snapshot_observed_at":"2026-07-06T06:42:54.610341Z","submitted_at":"2018-06-04T17:58:18Z","title":"Relational inductive biases, deep learning, and graph networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01261","snapshot_observed_at":"2026-08-11T16:10:24.349761Z","title":"Relational inductive biases, deep learning, and graph networks.arXiv preprint arXiv:1806.01261,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.349761Z"},"links":{"cited_paper":"/paper/1806.01261","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:250964ea1f6bf6d024f21a58b19a2f99c8aa9596fb8f511471f9f3b48cea0dba","observation_id":"7427fae4-df8e-46d1-a0c9-c20af3d4da2d","resolution":{"observed_at":"2026-08-11T16:10:24.349761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06349","last_updated":"2016-05-12T20:51:23Z","snapshot_observed_at":"2026-08-05T16:42:28.278134Z","submitted_at":"2015-11-19T20:38:45Z","title":"Generating Sentences from a Continuous Space","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06349","snapshot_observed_at":"2026-08-11T16:10:24.358794Z","title":"Gener- ating sentences from a continuous space.arXiv preprint arXiv:1511.06349,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.358794Z"},"links":{"cited_paper":"/paper/1511.06349","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:4be951a67bf57e58779ed3ccc476dbfc47aff67fae716274dff39e2b6c77c80c","observation_id":"7e36b659-41ea-4752-9195-a44461672f4b","resolution":{"observed_at":"2026-08-11T16:10:24.358794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-12T04:58:34.201421Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-11T16:10:24.376727Z","title":"Rethinking attention with performers","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.376727Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:f1daeb5fc354266e526313ec9b63642b8901cd5a57b00c53f419377a90b19ed6","observation_id":"83f6b872-f245-4baa-a1e2-9a1c47d490cb","resolution":{"observed_at":"2026-08-11T16:10:24.376727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:10:25.269885Z","title":"Bert: Pre-trainingofdeepbidirectional transformers for language understanding","venue":null,"work_id":"7a559b91-4ca9-4119-b554-551a77a8c127","year":2019},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.385298Z"},"links":{"citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:3c919cb54fd1a145c27c361a3d3e42582aa2b9763e58018be361ebd94332f848","observation_id":"d9a47901-9eaf-400a-a604-73c457ade573","resolution":{"observed_at":"2026-08-11T16:10:25.274237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T16:10:24.389874Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.389874Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:3a74e40832e574983a9e01b46cc3b92b141b716d04c4f526f56b7cdabada8c54","observation_id":"e6d5465d-4474-452c-a8eb-833942ae92e2","resolution":{"observed_at":"2026-08-11T16:10:24.389874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.07068","last_updated":"2017-06-21T18:05:13Z","snapshot_observed_at":"2026-07-06T05:47:54.334362Z","submitted_at":"2017-06-21T18:05:13Z","title":"CAN: Creative Adversarial Networks, Generating \"Art\" by Learning About Styles and Deviating from Style Norms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.07068","snapshot_observed_at":"2026-08-11T16:10:24.394557Z","title":"Can: Creative adversar- ial networks, generating\" art\" by learning about styles and deviating from style norms.arXiv preprint arXiv:1706.07068,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.394557Z"},"links":{"cited_paper":"/paper/1706.07068","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:c82d5bace8c80ac5d31542abcb7c94bd3b4762d01e9811bbe21e40cbb612f6bc","observation_id":"f54ccada-12c2-41af-ac50-34f96e1b4a62","resolution":{"observed_at":"2026-08-11T16:10:24.394557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.12595","last_updated":"2022-07-04T16:11:08Z","snapshot_observed_at":"2026-08-11T14:30:16.364289Z","submitted_at":"2020-08-28T11:49:33Z","title":"Dynamical Variational Autoencoders: A Comprehensive Review","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.12595","snapshot_observed_at":"2026-08-11T16:10:24.403727Z","title":"Dynamical variational autoencoders: A comprehensive review.arXiv preprint arXiv:2008.12595,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.403727Z"},"links":{"cited_paper":"/paper/2008.12595","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:08da45700ed6a6ea7060eecfedd8296d8cc5ccf8a1e2b63ea1073761079fb30b","observation_id":"8884d32c-e182-47ff-bc7a-9c7a37d68701","resolution":{"observed_at":"2026-08-11T16:10:24.403727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03206","last_updated":"2021-06-23T00:25:31Z","snapshot_observed_at":"2026-08-10T00:41:01.806631Z","submitted_at":"2021-03-04T18:20:50Z","title":"Perceiver: General Perception with Iterative Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03206","snapshot_observed_at":"2026-08-11T16:10:24.416947Z","title":"Perceiver: General perception with iterative attention.arXiv preprint arXiv:2103.03206,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.416947Z"},"links":{"cited_paper":"/paper/2103.03206","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:c7c3918c0052086146bec80b64a371a164176a3b032a7a62d7aae3136b36c0a3","observation_id":"fe6a8710-0a05-49f2-889a-ad9cb13ace8e","resolution":{"observed_at":"2026-08-11T16:10:24.416947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05918","last_updated":"2021-06-11T07:51:39Z","snapshot_observed_at":"2026-08-11T01:45:10.663640Z","submitted_at":"2021-02-11T10:08:12Z","title":"Scaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05918","snapshot_observed_at":"2026-08-11T16:10:24.421103Z","title":"Scaling up visual and vision-language repre- sentation learning with noisy text supervision.arXiv preprint arXiv:2102.05918,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.421103Z"},"links":{"cited_paper":"/paper/2102.05918","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:19de7359fbfa8f3de3570e50826aeb4ddb823e522ea34a2aba3d499228e80e71","observation_id":"d4e31344-cc47-4f90-869d-a5e383d9a828","resolution":{"observed_at":"2026-08-11T16:10:24.421103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07660","last_updated":"2021-07-16T01:25:23Z","snapshot_observed_at":"2026-08-10T12:12:05.950916Z","submitted_at":"2021-07-16T01:25:23Z","title":"The Teichm\\\"uller problem for $L^p$-means of distortion","version":1},"cited_work":{"arxiv_id":"2107.07660","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.07660","snapshot_observed_at":"2026-08-11T16:10:25.021484Z","title":"The Teichm\\\"uller problem for $L^p$-means of distortion","venue":"math.CV","work_id":"49c255ad-e19f-4414-b2a2-41df3f5277bc","year":2021},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.425298Z"},"links":{"cited_paper":"/paper/2107.07660","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:12b4857a9229aa2b274de0a0f387305941d27ce01a1fe45286c5121bacbc1a55","observation_id":"2bb48070-87f1-46a3-b97c-6faa56956ac3","resolution":{"observed_at":"2026-08-11T16:10:25.025996Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T16:10:24.429611Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.429611Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:4de0b1c560835e8776fb3ea67a1d565a62786cea9dc6de7734209e011c003c8c","observation_id":"8d319f06-7f84-4c9b-9061-33572c0b9075","resolution":{"observed_at":"2026-08-11T16:10:24.429611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T16:10:24.433746Z","title":"Auto-encoding variational bayes.arXiv preprint arXiv:1312.6114,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.433746Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:87243a2072d775882b34f8854e7cb451ddced2c7349d7a1396d9dbb2c24988f2","observation_id":"25c3c854-cd5e-436b-ad29-5480dfb0d24c","resolution":{"observed_at":"2026-08-11T16:10:24.433746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00630","last_updated":"2023-04-14T00:20:30Z","snapshot_observed_at":"2026-08-10T21:16:03.365645Z","submitted_at":"2021-07-01T17:43:20Z","title":"Variational Diffusion Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00630","snapshot_observed_at":"2026-08-11T16:10:24.438775Z","title":"Variational diffusion models.arXiv preprint arXiv:2107.00630,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.438775Z"},"links":{"cited_paper":"/paper/2107.00630","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:fccecc05e45546a3c26b2d08374bc8410c3754154d0749d54a2144a44df289eb","observation_id":"6b58ff09-8fd4-4c5b-9dab-cd13ec5502b9","resolution":{"observed_at":"2026-08-11T16:10:24.438775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.02907","last_updated":"2017-02-22T09:55:36Z","snapshot_observed_at":"2026-07-06T05:10:16.862707Z","submitted_at":"2016-09-09T19:48:41Z","title":"Semi-Supervised Classification with Graph Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.02907","snapshot_observed_at":"2026-08-11T16:10:24.444042Z","title":"Semi-supervised classification with graph convolutional networks.arXiv preprint arXiv:1609.02907,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.444042Z"},"links":{"cited_paper":"/paper/1609.02907","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:48c6583d7273cae00ff27f84101c8477d3399d0ab668ddfe48eddfe73d9becf1","observation_id":"394f0fe9-6898-4dfd-baf7-cdace0634589","resolution":{"observed_at":"2026-08-11T16:10:24.444042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:10:24.462002Z","title":"Multimodality representation learning: A survey on evolution, pretraining and its applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.462002Z"},"links":{"citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:a45865a096c94fe38eabfd2a6f9d03d470e667b1286fa3d7d0cdf4f6302fc0d3","observation_id":"cbb814e9-1596-4488-b0af-4d6bd875e0c6","resolution":{"observed_at":"2026-08-11T16:10:24.462002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-11T16:10:24.469761Z","title":"Mixed precision training.arXiv preprint arXiv:1710.03740,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.469761Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:341721a758518d280ebd3ca6226de65f9a9cac37ebd888e102766931a39bda46","observation_id":"e62c057b-3ab8-4024-b058-819c28ddbf6d","resolution":{"observed_at":"2026-08-11T16:10:24.469761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09415","last_updated":"2025-03-13T19:12:25Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:58Z","title":"An Image is Worth More Than 16x16 Patches: Exploring Transformers on Individual Pixels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09415","snapshot_observed_at":"2026-08-11T16:10:24.478244Z","title":"An image is worth more than 16x16 patches: Exploring transformers on individual pixels.arXiv preprint arXiv:2406.09415,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.478244Z"},"links":{"cited_paper":"/paper/2406.09415","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:d6e5ab5d355888636884bcf3b172e18208b8fcd878ee166e75f21910464d1b58","observation_id":"7b92f721-fd81-40e5-b34a-f670792c50bd","resolution":{"observed_at":"2026-08-11T16:10:24.478244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.17249","last_updated":"2021-03-31T17:51:25Z","snapshot_observed_at":"2026-08-11T22:23:23.435510Z","submitted_at":"2021-03-31T17:51:25Z","title":"StyleCLIP: Text-Driven Manipulation of StyleGAN Imagery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.17249","snapshot_observed_at":"2026-08-11T16:10:24.482408Z","title":"Styleclip: Text-driven manipulation of stylegan imagery.arXiv preprint arXiv:2103.17249,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.482408Z"},"links":{"cited_paper":"/paper/2103.17249","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:37045a1042035fbdff424c6a6c6f4d4e742c50bdfb52319a9d2f40ffd1ed2c0b","observation_id":"5ac36930-5e1f-4d18-aa71-3855f7904b6b","resolution":{"observed_at":"2026-08-11T16:10:24.482408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06434","last_updated":"2016-01-07T23:09:39Z","snapshot_observed_at":"2026-08-04T04:34:27.861448Z","submitted_at":"2015-11-19T22:50:32Z","title":"Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06434","snapshot_observed_at":"2026-08-11T16:10:24.487032Z","title":"Unsupervised representation learning with deep convolu- tional generative adversarial networks.arXiv preprint arXiv:1511.06434,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.487032Z"},"links":{"cited_paper":"/paper/1511.06434","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:1314942abb500b6b727b35b2e34f0014d915d0777ecc179a8f2acfa6be360f0f","observation_id":"0e1fb69a-cd79-4721-af97-161eb9ccdb45","resolution":{"observed_at":"2026-08-11T16:10:24.487032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03591","last_updated":"2022-12-22T16:35:40Z","snapshot_observed_at":"2026-07-06T14:27:50.004915Z","submitted_at":"2022-12-07T12:12:04Z","title":"A $p$-adic approach to the existence of level-raising congruences","version":2},"cited_work":{"arxiv_id":"2212.03591","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.03591","snapshot_observed_at":"2026-08-11T16:10:24.862110Z","title":"A $p$-adic approach to the existence of level-raising congruences","venue":"math.NT","work_id":"132bccdd-68d2-422c-a0a0-ff3298c55049","year":2022},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.491160Z"},"links":{"cited_paper":"/paper/2212.03591","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:10cf482467d6816f99b3f0f83ceb7cb8fd212d4261f55330fb79d1d3132113cd","observation_id":"ac376bd5-7035-4567-b917-f25e28510a8a","resolution":{"observed_at":"2026-08-11T16:10:24.867415Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.07262","last_updated":"2019-04-18T12:09:05Z","snapshot_observed_at":"2026-08-03T02:26:04.005483Z","submitted_at":"2017-07-23T07:53:00Z","title":"Investigating different $\\Lambda$ and $\\bar\\Lambda$ polarizations in relativistic heavy-ion collisions","version":3},"cited_work":{"arxiv_id":"1707.07262","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.07262","snapshot_observed_at":"2026-08-11T16:10:24.831234Z","title":"Investigating different $\\Lambda$ and $\\bar\\Lambda$ polarizations in relativistic heavy-ion collisions","venue":"nucl-th","work_id":"517a6bd1-7583-48ad-8013-e85f5051532e","year":2017},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.499563Z"},"links":{"cited_paper":"/paper/1707.07262","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:eeee910b95df98d0b479783258a55afecd6eb10560a67d9fe190a890f0e1c07c","observation_id":"1627ebcc-bccf-491a-abbe-19ce1ebe7ec4","resolution":{"observed_at":"2026-08-11T16:10:24.838393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-11T16:10:24.504494Z","title":"Zero-shot text-to-image generation.arXiv preprint arXiv:2102.12092,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.504494Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:e575e206ef67e15631710a136c92249971287a4b43e725e58b62b00753b83e28","observation_id":"6b601167-6764-4032-90e2-5fff56158bb9","resolution":{"observed_at":"2026-08-11T16:10:24.504494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1401.4082","last_updated":"2014-05-30T10:00:36Z","snapshot_observed_at":"2026-08-10T07:14:44.150914Z","submitted_at":"2014-01-16T16:33:23Z","title":"Stochastic Backpropagation and Approximate Inference in Deep Generative Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1401.4082","snapshot_observed_at":"2026-08-11T16:10:24.509096Z","title":"Stochasticbackpropagationandapproximate inference in deep generative models.arXiv preprint arXiv:1401.4082,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.509096Z"},"links":{"cited_paper":"/paper/1401.4082","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:b262b64c7d5832342f8302600db5db52d581c7c5f93b229c639e0a94a1e25e1c","observation_id":"bde5df70-3464-4ab6-9736-b514201491cd","resolution":{"observed_at":"2026-08-11T16:10:24.509096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05433","last_updated":"2019-11-05T17:37:20Z","snapshot_observed_at":"2026-08-09T20:28:52.254146Z","submitted_at":"2019-06-10T17:51:47Z","title":"Tackling Climate Change with Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05433","snapshot_observed_at":"2026-08-11T16:10:24.513983Z","title":"Donti, Lynn H","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.513983Z"},"links":{"cited_paper":"/paper/1906.05433","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:f9e0a66bc1a57b2d741cfb584060cfcc3a7f58e3913180c045aed345ee85c58a","observation_id":"29ead39b-cf1a-43cf-939c-30d9b7791f5b","resolution":{"observed_at":"2026-08-11T16:10:24.513983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-10T22:24:05.831832Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-11T16:10:24.518614Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.518614Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:7654bfaac310c8dcdb91e408899720f8e15c43997d691d917bdfde9f8cbf2e33","observation_id":"c893a510-082f-46ba-8a34-2f7bb7bdaac7","resolution":{"observed_at":"2026-08-11T16:10:24.518614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01761","last_updated":"2024-01-30T17:38:54Z","snapshot_observed_at":"2026-08-12T01:34:39.920528Z","submitted_at":"2024-01-30T17:38:54Z","title":"Rethinking Interpretability in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01761","snapshot_observed_at":"2026-08-11T16:10:24.522799Z","title":"Rethinking inter- pretability in the era of large language models.arXiv preprint arXiv:2402.01761,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.522799Z"},"links":{"cited_paper":"/paper/2402.01761","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:6b1e68e740c254a4f9e0a374d541a5037952c34604ba1bd53e79d00798f726cc","observation_id":"e04274d3-da37-4ee8-b46a-ce6af4f555bf","resolution":{"observed_at":"2026-08-11T16:10:24.522799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.03585","last_updated":"2015-11-18T21:50:51Z","snapshot_observed_at":"2026-07-06T04:11:47.439779Z","submitted_at":"2015-03-12T04:51:37Z","title":"Deep Unsupervised Learning using Nonequilibrium Thermodynamics","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.03585","snapshot_observed_at":"2026-08-11T16:10:24.526638Z","title":"Deepunsupervisedlearning using nonequilibrium thermodynamics.arXiv preprint arXiv:1503.03585,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.526638Z"},"links":{"cited_paper":"/paper/1503.03585","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:bee644b622f8fbc3b27c43c276e559418c6a2238db42cf12eba8c92cc34e7d2b","observation_id":"0b5752ff-826a-47cd-abd2-b71d2732d9fd","resolution":{"observed_at":"2026-08-11T16:10:24.526638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-11T16:10:24.530936Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.530936Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:ea121cdf94991c7d560295245da81f00362d3459729c6a36fbe99edb6db2e2d0","observation_id":"e3e3c3e5-275c-44c9-bed4-8000a9c098b1","resolution":{"observed_at":"2026-08-11T16:10:24.530936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02243","last_updated":"2019-06-05T18:40:53Z","snapshot_observed_at":"2026-08-08T05:13:40.118908Z","submitted_at":"2019-06-05T18:40:53Z","title":"Energy and Policy Considerations for Deep Learning in NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02243","snapshot_observed_at":"2026-08-11T16:10:24.536108Z","title":"The carbon footprint of training large transformer models","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.536108Z"},"links":{"cited_paper":"/paper/1906.02243","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:00cd8e8beef1f1e2ae24cc440614bb41fefaa2dacd1f056bd13b661d84466a2f","observation_id":"10e3dfdb-78b7-460b-b279-84fe28e31cff","resolution":{"observed_at":"2026-08-11T16:10:24.536108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07120","last_updated":"2018-02-26T15:23:53Z","snapshot_observed_at":"2026-08-06T14:45:14.372227Z","submitted_at":"2017-05-19T10:07:00Z","title":"VAE with a VampPrior","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07120","snapshot_observed_at":"2026-08-11T16:10:24.545211Z","title":"Vae with a vampprior.arXiv preprint arXiv:1705.07120,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.545211Z"},"links":{"cited_paper":"/paper/1705.07120","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:062222bf82613fd071bffdddc292ce50ab35aa2641ace3025fbb2c998761596a","observation_id":"bd978a44-f73f-4f5f-b71c-4ec14636f11f","resolution":{"observed_at":"2026-08-11T16:10:24.545211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16508","last_updated":"2025-05-01T03:41:42Z","snapshot_observed_at":"2026-08-12T00:32:22.405025Z","submitted_at":"2024-11-25T15:44:42Z","title":"All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16508","snapshot_observed_at":"2026-08-11T16:10:24.549899Z","title":"All languages matter: Evaluating lmms on culturally diverse 100 languages.arXiv preprint arXiv:2411.16508,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.549899Z"},"links":{"cited_paper":"/paper/2411.16508","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:b89ccd6d16a4a107e317d8cd186938d378735e1bd630ec8b4ba1686a2bb76b8e","observation_id":"5d4b01fe-a3d4-4c3d-9dd6-62c144bacea9","resolution":{"observed_at":"2026-08-11T16:10:24.549899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10903","last_updated":"2018-02-04T19:13:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-10-30T12:41:12Z","title":"Graph Attention Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10903","snapshot_observed_at":"2026-08-11T16:10:24.553977Z","title":"Graph attention networks.arXiv preprint arXiv:1710.10903,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.553977Z"},"links":{"cited_paper":"/paper/1710.10903","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:dd000aef67d3e9cfeb8b0319a13f49640faa956a59d2adc70ef7cbab44275470","observation_id":"b1ee4618-26b4-47c6-8191-330e428c632a","resolution":{"observed_at":"2026-08-11T16:10:24.553977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-11T16:10:24.557854Z","title":"Li, Madian Khabsa, Han Fang, and Hao Ma","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.557854Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:be21cce8ba67eb882ca37dc47683c4c62ed472f63e6ed039def0bb7bff30f1e7","observation_id":"a72e9957-da6f-47f8-bbd0-62e1729f8b45","resolution":{"observed_at":"2026-08-11T16:10:24.557854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-07-06T11:08:17.373935Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-11T16:10:24.561725Z","title":"Enhancing conversational recommendation systems with representation fusion.ACM Transactions on the Web, 2023b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.561725Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:ddbb8916ee87ea4af7cfa6fc2e2991781802641af61e537354abd5849b3565c0","observation_id":"302f1e60-94cd-4a1f-960b-3778792dc608","resolution":{"observed_at":"2026-08-11T16:10:24.561725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07922","last_updated":"2023-05-20T07:27:15Z","snapshot_observed_at":"2026-08-08T01:28:05.271964Z","submitted_at":"2023-05-13T14:23:07Z","title":"CodeT5+: Open Code Large Language Models for Code Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07922","snapshot_observed_at":"2026-08-11T16:10:24.565437Z","title":"Codet5+: Opencodelargelanguage models for codeunderstanding andgeneration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.565437Z"},"links":{"cited_paper":"/paper/2305.07922","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:69a5c1f0183d3c3f21de5c142c7e26ab52cdcd67370dad483b3d18d8778fe362","observation_id":"ee6dce1d-30db-4427-a0e6-1988af665268","resolution":{"observed_at":"2026-08-11T16:10:24.565437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:10:25.245595Z","title":"Wav2clip: Learning robust audio representations from clip","venue":null,"work_id":"9256e842-9971-45ec-a1d4-5db40cf1b4a6","year":2022},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.569357Z"},"links":{"citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:c62d26574c3d7b060c580c0a9ae845cca3a7288afa70ea87f620eee4fc2f4982","observation_id":"8494cb5d-6e9e-4545-945c-7322f0862b72","resolution":{"observed_at":"2026-08-11T16:10:25.249895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00826","last_updated":"2019-02-22T19:15:54Z","snapshot_observed_at":"2026-07-06T07:05:24.565760Z","submitted_at":"2018-10-01T17:11:31Z","title":"How Powerful are Graph Neural Networks?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00826","snapshot_observed_at":"2026-08-11T16:10:24.572960Z","title":"Unsupervised anomaly detection via variational auto-encoder for seasonal kpis in web applications","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.572960Z"},"links":{"cited_paper":"/paper/1810.00826","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:1850187ed35d5c0fa8212ca4bb7b965173109c56a3a2414cebbf5c39c6c75176","observation_id":"acbd9688-5fa2-4e12-ba92-e73a29092720","resolution":{"observed_at":"2026-08-11T16:10:24.572960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14217","last_updated":"2022-05-27T20:12:09Z","snapshot_observed_at":"2026-08-11T00:45:45.103690Z","submitted_at":"2022-05-27T20:12:09Z","title":"Diffusion-LM Improves Controllable Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14217","snapshot_observed_at":"2026-08-11T16:10:24.577588Z","title":"Diffsound: Discrete diffusion model for text-to- speech","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.577588Z"},"links":{"cited_paper":"/paper/2205.14217","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:1b6b330c35ae4eb8fdff4c83c89690126516b670169a72496b6cf5c849eea554","observation_id":"27ca9c73-0934-4e9a-a96b-47ceda26e2c1","resolution":{"observed_at":"2026-08-11T16:10:24.577588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15992","last_updated":"2024-10-11T05:42:01Z","snapshot_observed_at":"2026-07-06T18:35:31.141952Z","submitted_at":"2024-06-23T02:59:15Z","title":"Can LLM Graph Reasoning Generalize beyond Pattern Memorization?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15992","snapshot_observed_at":"2026-08-11T16:10:24.581568Z","title":"Da-vegan: Differentiably augmenting vae-gan for microstructure reconstruction from extremely small data sets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.581568Z"},"links":{"cited_paper":"/paper/2406.15992","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:b1e405feced1b059120e72d3160fcb3d4c5fc66193df0bac2289c4bb2563e7e8","observation_id":"0711777e-c6e2-4eb4-bf92-73dada3d7549","resolution":{"observed_at":"2026-08-11T16:10:24.581568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01518","last_updated":"2022-03-21T08:27:06Z","snapshot_observed_at":"2026-07-06T12:14:49.815939Z","submitted_at":"2021-12-02T18:59:32Z","title":"DenseCLIP: Language-Guided Dense Prediction with Context-Aware Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01518","snapshot_observed_at":"2026-08-11T16:10:24.585381Z","title":"Denseclip: Language-guided dense prediction with context-aware prompting.arXiv preprint arXiv:2112.01518,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.585381Z"},"links":{"cited_paper":"/paper/2112.01518","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:77f57b94f4d0f7b09334e67d23e42be2da30a8f92aaff0c47473c455ecb77b6a","observation_id":"27c6fa9d-367c-4819-8c42-f5167431e1df","resolution":{"observed_at":"2026-08-11T16:10:24.585381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08894","last_updated":"2017-09-05T15:15:45Z","snapshot_observed_at":"2026-07-06T05:44:07.391932Z","submitted_at":"2017-05-24T18:00:00Z","title":"Wandering in the Lyman-alpha Forest: A Study of Dark Matter-Dark Radiation Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.08894","snapshot_observed_at":"2026-08-11T16:10:24.465778Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":1943,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.465778Z"},"links":{"cited_paper":"/paper/1705.08894","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:9e232b7e683bb25ce1bec4bc33e3639bf4551e826d0b0b50c3c17e3625636976","observation_id":"95591213-6ab1-4025-bf31-c053b04203f2","resolution":{"observed_at":"2026-08-11T16:10:24.465778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-11T16:10:24.474024Z","title":"Mirza and S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":1969,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.474024Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:aa8389910a35f7fb5875ff96edd12214e2d224e5dfc6b0caba2651816dd7960f","observation_id":"b7f31c53-21e7-4fa7-9822-6158b68f9eab","resolution":{"observed_at":"2026-08-11T16:10:24.474024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.01212","last_updated":"2017-06-12T20:52:56Z","snapshot_observed_at":"2026-08-07T07:38:05.448298Z","submitted_at":"2017-04-04T23:00:44Z","title":"Neural Message Passing for Quantum Chemistry","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.01212","snapshot_observed_at":"2026-08-11T16:10:24.399105Z","title":"Neural message passing for quantum chemistry.arXiv preprint arXiv:1704.01212,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.399105Z"},"links":{"cited_paper":"/paper/1704.01212","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:e8e21646b9e18251a448a531c7135f1337980349e81ae0debe268a9e048c3c38","observation_id":"eaeeea57-9a9d-44f9-9868-ead7e148a9f7","resolution":{"observed_at":"2026-08-11T16:10:24.399105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.07543","last_updated":"2018-07-23T18:26:40Z","snapshot_observed_at":"2026-08-04T02:57:12.964401Z","submitted_at":"2018-07-19T17:17:23Z","title":"Understanding and Improving Interpolation in Autoencoders via an Adversarial Regularizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.07543","snapshot_observed_at":"2026-08-11T16:10:24.354192Z","title":"Understanding and improving interpolation in autoencoders via an adversarial regularizer.arXiv preprint arXiv:1807.07543,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.354192Z"},"links":{"cited_paper":"/paper/1807.07543","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:900bdc0b254cc3aab5a4d3bf02a7ecff17f3460f0a7c676ebe35c2935bb2b2bf","observation_id":"a0a76fb7-064b-4650-b210-c7d53e922a9b","resolution":{"observed_at":"2026-08-11T16:10:24.354192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05225","last_updated":"2017-12-25T11:09:06Z","snapshot_observed_at":"2026-08-06T22:13:27.249372Z","submitted_at":"2017-11-14T17:58:50Z","title":"CheXNet: Radiologist-Level Pneumonia Detection on Chest X-Rays with Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05225","snapshot_observed_at":"2026-08-11T16:10:24.495215Z","title":"Lungren, Kather- ine Shpanskaya, Wynton Dillon, and Curtis P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.495215Z"},"links":{"cited_paper":"/paper/1711.05225","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:b781ae16c7aaf123e552269c64f3a8a13d5e7da2116c50217c23ed1583b0a5ed","observation_id":"7dc0e002-e3cb-4810-81c4-80af931883fb","resolution":{"observed_at":"2026-08-11T16:10:24.495215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:10:25.257820Z","title":"A theoretical framework for back-propagation","venue":null,"work_id":"78a3ea53-783e-4ce1-bb84-8f7d5373e9d1","year":1988},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.453916Z"},"links":{"citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:86fcbbd2debbd3f942e880a70152773cca1d4b77346a843b95fabb1c51b0587a","observation_id":"a3b38949-66db-4c8c-a0d9-30d31b465395","resolution":{"observed_at":"2026-08-11T16:10:25.261773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07213","last_updated":"2020-04-20T19:10:58Z","snapshot_observed_at":"2026-08-08T06:44:34.550459Z","submitted_at":"2020-04-15T17:15:35Z","title":"Toward Trustworthy AI Development: Mechanisms for Supporting Verifiable Claims","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07213","snapshot_observed_at":"2026-08-11T16:10:24.368040Z","title":"Toward trustworthy ai development: Mechanisms for sup- porting verifiable claims.arXiv preprint arXiv:2004.07213,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.368040Z"},"links":{"cited_paper":"/paper/2004.07213","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:ba37794cbed6bd933e50e363b145c9bed666dcfa1e6f6fd1ad1a452ecf30977b","observation_id":"41d24fdd-0680-416a-ba2d-ee2ff2429746","resolution":{"observed_at":"2026-08-11T16:10:24.368040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.04623","last_updated":"2015-05-20T15:29:42Z","snapshot_observed_at":"2026-07-06T04:09:23.043748Z","submitted_at":"2015-02-16T16:48:56Z","title":"DRAW: A Recurrent Neural Network For Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.04623","snapshot_observed_at":"2026-08-11T16:10:24.408052Z","title":"Draw: A recurrent neural network for image generation.arXiv preprint arXiv:1502.04623,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.408052Z"},"links":{"cited_paper":"/paper/1502.04623","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:3746d34ce06c77e1fb4b76cfe6a7bc8daca4c24dd4393295cc4405d3e7031546","observation_id":"cdf5a589-0002-4826-859e-69fe3aea5a60","resolution":{"observed_at":"2026-08-11T16:10:24.408052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-11T16:10:24.412313Z","title":"Conformer: Convolution-augmented transformer for speech recog- nition","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.412313Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:0113a37835b24019c2ec1edf3afdbf7882685610cc4d5b92d8f10a7f2d147ad1","observation_id":"c29e5446-e879-48c3-ae36-b9cf25835a2d","resolution":{"observed_at":"2026-08-11T16:10:24.412313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04451","last_updated":"2020-02-18T16:01:18Z","snapshot_observed_at":"2026-07-06T08:50:12.690900Z","submitted_at":"2020-01-13T18:38:28Z","title":"Reformer: The Efficient Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04451","snapshot_observed_at":"2026-08-11T16:10:24.449206Z","title":"Reformer: The efficient transformer.arXiv preprint arXiv:2001.04451,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.449206Z"},"links":{"cited_paper":"/paper/2001.04451","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:5c82b2b7ec76f8dd2b6775a6b0646c4ce994cf8916309f475a5f824714d3baea","observation_id":"92cc66b8-344f-4559-87fe-b133b8e691ba","resolution":{"observed_at":"2026-08-11T16:10:24.449206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-07-06T05:27:45.080675Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-11T16:10:24.336849Z","title":"Wasserstein gan.arXiv preprint arXiv:1701.07875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.336849Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:74fab0efb44dbf52dc2cbc6269bc2e852695bbbeee08a36edcaf1e911cc80573","observation_id":"d5bf1737-7d7b-42fa-90df-1f315eead6d6","resolution":{"observed_at":"2026-08-11T16:10:24.336849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05587","last_updated":"2017-12-05T18:06:21Z","snapshot_observed_at":"2026-08-07T13:44:53.690521Z","submitted_at":"2017-06-17T22:48:57Z","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05587","snapshot_observed_at":"2026-08-11T16:10:24.372582Z","title":"Rethinking atrous convolution for semantic image segmentation.arXiv preprint arXiv:1706.05587,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.372582Z"},"links":{"cited_paper":"/paper/1706.05587","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:ccbcc481b85ec826183f5b949766751c904b58a3cf7096b5d4cad12e6cfb70fb","observation_id":"5a69a2d8-c3b9-4d09-abc2-bd874521e2f5","resolution":{"observed_at":"2026-08-11T16:10:24.372582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11106","last_updated":"2024-05-17T22:10:23Z","snapshot_observed_at":"2026-08-05T03:50:46.269415Z","submitted_at":"2024-05-17T22:10:23Z","title":"LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11106","snapshot_observed_at":"2026-08-11T16:10:24.540443Z","title":"Llm-based multi-agent reinforcement learning: Current and future directions.arXiv preprint arXiv:2405.11106,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.540443Z"},"links":{"cited_paper":"/paper/2405.11106","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:41aa032dbf88266003bee8e4f0e7598e768c800f9b367e1436ff2bf5108a3a08","observation_id":"52332e50-919e-4ff0-9509-22f09a427e1e","resolution":{"observed_at":"2026-08-11T16:10:24.540443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6203","last_updated":"2014-05-21T16:27:09Z","snapshot_observed_at":"2026-07-06T03:31:33.797310Z","submitted_at":"2013-12-21T04:25:53Z","title":"Spectral Networks and Locally Connected Networks on Graphs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6203","snapshot_observed_at":"2026-08-11T16:10:24.363468Z","title":"Spectral networks and locally connected networks on graphs.arXiv preprint arXiv:1312.6203,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.363468Z"},"links":{"cited_paper":"/paper/1312.6203","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:99ee580e9be926e853db79374d4d13a4053af1a6a91d64dc3a725e9e142ad61b","observation_id":"4ac0734e-7374-40ea-a814-e1d3bce80ce1","resolution":{"observed_at":"2026-08-11T16:10:24.363468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:10:25.282577Z","title":"Safari: Cross-lingual bias and factuality detection in news media and news articles","venue":null,"work_id":"498d8940-99ca-407f-b765-c0f04ed94ddb","year":2024},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.341216Z"},"links":{"citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:54ad4adc5af46ea5912b2a1d6fcea6a6c2825faf4cba8b6de8935ca4061aa8f1","observation_id":"0bd6fa62-60ec-47e3-94e4-a9f21c312a50","resolution":{"observed_at":"2026-08-11T16:10:25.287058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12928","last_updated":"2024-06-15T12:02:14Z","snapshot_observed_at":"2026-08-06T16:08:25.212227Z","submitted_at":"2024-06-15T12:02:14Z","title":"Evaluating the Generalization Ability of Quantized LLMs: Benchmark, Analysis, and Toolbox","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12928","snapshot_observed_at":"2026-08-11T16:10:24.457738Z","title":"Evaluating the generalization ability of quantized llms: Benchmark, analysis, and toolbox","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.457738Z"},"links":{"cited_paper":"/paper/2406.12928","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:2f6b84c72e040f1d0f5244c9ac59e6947b490ea9427c0a7fe547d1a94d5402bc","observation_id":"1ed240f6-d27d-4786-ac11-27568c9f2e0a","resolution":{"observed_at":"2026-08-11T16:10:24.457738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03817","last_updated":"2024-12-09T09:20:11Z","snapshot_observed_at":"2026-08-08T03:30:04.857103Z","submitted_at":"2024-11-06T10:35:11Z","title":"From Novice to Expert: LLM Agent Policy Optimization via Step-wise Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03817","snapshot_observed_at":"2026-08-11T16:10:24.380984Z","title":"From novice to expert: Llm agent policy optimization via step-wise reinforcement learning.arXiv preprint arXiv:2411.03817,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.380984Z"},"links":{"cited_paper":"/paper/2411.03817","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:e38311a71573500cacc07cfbb6cda793bc8221028da97cdec2f399e8341531a5","observation_id":"98720c7b-4580-4b04-b01f-13e276d5a5ba","resolution":{"observed_at":"2026-08-11T16:10:24.380984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-11T16:10:24.345297Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T16:10:24.345297Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2412.16188"},"observation_digest":"sha256:72c0c9f872112ea1530453f432b64cd16fdc1e91582e72ca11ef26b0c92d4fbe","observation_id":"0638224e-f2ff-4445-ad09-f0d5eb090c94","resolution":{"observed_at":"2026-08-11T16:10:24.345297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.16188","last_updated":"2024-12-13T17:55:39Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T00:32:41.332600Z","submitted_at":"2024-12-13T17:55:39Z","title":"A Decade of Deep Learning: A Survey on The Magnificent Seven"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":52,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2412.16188."}