{"as_of":"2026-08-14T22:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e0600b5d2f29d791614b8db03fbc719a496772b33cc3e0438c47168efd6b474","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:25:09.332645Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.11250/citation-record","integrity":"/paper/1908.11250/integrity","json":"/paper/1908.11250/citation-record.json","paper":"/paper/1908.11250"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1603.04467","last_updated":"2016-03-16T16:57:12Z","snapshot_observed_at":"2026-08-14T22:06:04.800050Z","submitted_at":"2016-03-14T20:50:20Z","title":"TensorFlow: Large-Scale Machine Learning on Heterogeneous Distributed Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.04467","snapshot_observed_at":"2026-08-14T10:25:09.071226Z","title":"Abadi, A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.071226Z"},"links":{"cited_paper":"/paper/1603.04467","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:35568c1b4e63b59cb472fff25b90c60d54529198cc5a841e2cbe7ca663e9041e","observation_id":"23d99ed7-b94b-4b44-8260-2679c58db067","resolution":{"observed_at":"2026-08-14T10:25:09.071226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.05162","last_updated":"2017-11-23T09:34:28Z","snapshot_observed_at":"2026-08-14T21:30:12.382790Z","submitted_at":"2016-11-16T06:34:41Z","title":"Net-Trim: Convex Pruning of Deep Neural Networks with Performance Guarantee","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.05162","snapshot_observed_at":"2026-08-14T10:25:09.077944Z","title":"Aghasi, N","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.077944Z"},"links":{"cited_paper":"/paper/1611.05162","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:e014687410cedae81e6844472de2731f729fcfed917bed90df58fdb391f41b17","observation_id":"f461308f-27b0-4e1f-9f4d-70a76e10bfc0","resolution":{"observed_at":"2026-08-14T10:25:09.077944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06211","last_updated":"2016-11-18T19:55:29Z","snapshot_observed_at":"2026-08-14T21:29:42.664960Z","submitted_at":"2016-11-18T19:55:29Z","title":"NoiseOut: A Simple Way to Prune Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06211","snapshot_observed_at":"2026-08-14T10:25:09.082929Z","title":"Babaeizadeh, P","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.082929Z"},"links":{"cited_paper":"/paper/1611.06211","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:1bc0c344bea8a7b2eae5097e0dfbee5d5e28ec039701dee59ddc91096d584f03","observation_id":"c3eb77d4-684d-4604-8b68-1292a0b3f92d","resolution":{"observed_at":"2026-08-14T10:25:09.082929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-12T12:07:33.202888Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-14T10:25:09.088182Z","title":"Bahdanau, K","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.088182Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:4e66d035787a6737fbb6f9932004f611e38d3165f6988e384572191ee292b7d5","observation_id":"ac6b467a-8d1c-4912-960c-dfac8253c314","resolution":{"observed_at":"2026-08-14T10:25:09.088182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.312969Z","title":"Chang and C.-J","venue":null,"work_id":"7c1f184f-a65f-4b85-94d4-f5f0b824c341","year":2011},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.095230Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:14baeaced9a801590ba71827af895da34e5c0f4e3b525eb211c670905187abc6","observation_id":"61b20287-43e7-47ae-8d57-0b1e608a8901","resolution":{"observed_at":"2026-08-14T10:25:10.318329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.1442","last_updated":"2014-12-03T19:08:38Z","snapshot_observed_at":"2026-08-07T05:31:59.987658Z","submitted_at":"2014-12-03T19:08:38Z","title":"Memory Bounded Deep Convolutional Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.1442","snapshot_observed_at":"2026-08-14T10:25:09.100385Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.100385Z"},"links":{"cited_paper":"/paper/1412.1442","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:1c39c28168aaedbc901c02498494134b98401331d57a7d919f45edd308b15d54","observation_id":"90a468df-319d-4f65-b846-e588bffa524f","resolution":{"observed_at":"2026-08-14T10:25:09.100385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.292158Z","title":null,"venue":null,"work_id":"7c6621f2-0ec3-4b24-a800-0040d6b41dcf","year":1968},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.105793Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:87d9ad1b104a48b1936c03c5ba06e90b83ff949677f9a1cb3496d1615e2bf93d","observation_id":"61e3d00c-c45b-4bec-97e5-103b0474e7bc","resolution":{"observed_at":"2026-08-14T10:25:10.298872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1308.0850","last_updated":"2014-06-05T16:04:02Z","snapshot_observed_at":"2026-08-05T10:16:44.137827Z","submitted_at":"2013-08-04T21:04:36Z","title":"Generating Sequences With Recurrent Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.0850","snapshot_observed_at":"2026-08-14T10:25:09.111343Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.111343Z"},"links":{"cited_paper":"/paper/1308.0850","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:8eb4d6873606ce291d2434707f613f299692cab74ce175916b9a7ce9e2fbc590","observation_id":"8414d042-ec0f-40bf-8ecc-03b822a55140","resolution":{"observed_at":"2026-08-14T10:25:09.111343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.275326Z","title":null,"venue":null,"work_id":"ae808e2f-bdb6-4963-8b31-ee178fc0265c","year":1998},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.116469Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:12c8e553444dfd0ae7f76461e5636501a7e4adcde4070ac5ba120ff58487737a","observation_id":"218b2c0e-2954-4c68-8903-54080f785e2b","resolution":{"observed_at":"2026-08-14T10:25:10.281190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-14T10:25:09.121455Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.121455Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:a0759e5b86472bcc903f7a3b6c4ead71691b69ef82532062c98a9ca6929363ca","observation_id":"b269931a-e24e-4eb8-b811-edac520c74f8","resolution":{"observed_at":"2026-08-14T10:25:09.121455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.257844Z","title":null,"venue":null,"work_id":"43ed372d-2e03-4c02-97cf-23471a527ea9","year":null},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.127407Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:1a8e723b98e9ca77d5c5878281d4183d9ea77b4078ac02040c0b465ca15ba1ac","observation_id":"56371412-b134-4ce1-b413-08c602c661b1","resolution":{"observed_at":"2026-08-14T10:25:10.265206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-14T10:25:09.132315Z","title":"Hannun, C","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.132315Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:3fafebfbe42da156be3fe12c3139e14945104e9583674277a5af708daafdcb16","observation_id":"41cf3a2e-2106-430e-b822-9744a8f75c74","resolution":{"observed_at":"2026-08-14T10:25:09.132315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.234006Z","title":null,"venue":null,"work_id":"dfa16480-b84c-4261-83f7-25f3a85cc21f","year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.137318Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:e4d37fab5ddb8f4e41d327b5f301b075783d146ffb76543cfb608985a1562740","observation_id":"d4dcb61c-3e76-4b88-a812-cd2fdc3e9f18","resolution":{"observed_at":"2026-08-14T10:25:10.239493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.212585Z","title":null,"venue":null,"work_id":"62d9f1c7-f852-4dff-8b85-6e8d400692bb","year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.142903Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:865a5cc560c212d2f451be7dac8e35932d0b75b19a7da332a1a2259d379c89ac","observation_id":"c143e55e-8a8b-4ac0-bc8b-9f3e60b66277","resolution":{"observed_at":"2026-08-14T10:25:10.219444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.195962Z","title":null,"venue":null,"work_id":"603099f4-efb4-4271-9ba8-cc59bf349521","year":2012},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.147977Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:ceaeb5bc5bffef4757b6578fc52c08b76918884095f7ddcc4d4006728a9fd6a7","observation_id":"3dc5f076-2805-4c7f-8c89-77811fe4ab1f","resolution":{"observed_at":"2026-08-14T10:25:10.201392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.06993","last_updated":"2018-01-28T17:12:02Z","snapshot_observed_at":"2026-08-14T21:42:53.838437Z","submitted_at":"2016-08-25T00:44:55Z","title":"Densely Connected Convolutional Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.06993","snapshot_observed_at":"2026-08-14T10:25:09.154525Z","title":"Huang, Z","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.154525Z"},"links":{"cited_paper":"/paper/1608.06993","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:a5136464a8e4269dfca47cc8238fae1995350b3f14306935fa88e3af9b45c404","observation_id":"8cc733e6-48cd-4017-8c61-68120cb70b8d","resolution":{"observed_at":"2026-08-14T10:25:09.154525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1265.82531","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.696574Z","title":"Hubara, M","venue":null,"work_id":"0a5aa370-3db2-49cf-824b-c6883a667bb4","year":null},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.160207Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:b5d44c368cae39b97bf42f4132dd9a2961c2f075bfe33c22182fa58a8f1a0ab4","observation_id":"77b9580b-c48d-4c47-8ea5-95eab94f7faf","resolution":{"observed_at":"2026-08-14T10:25:09.706156Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.180724Z","title":"Learning a hyperplane classiﬁer by minimizing an exact bound on the vc dimensioni","venue":null,"work_id":"ac0ed19c-dd6c-426e-bf2a-40ebb62cfbc1","year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.167078Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:d2bb9fbcd4336412e5cfa766bb82dba61f484226e7fa8288dbb2f900a16f893d","observation_id":"9314f22a-4fe1-4511-b8e0-23152d86ec13","resolution":{"observed_at":"2026-08-14T10:25:10.185358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.164761Z","title":null,"venue":null,"work_id":"ca41d158-e10d-49d9-9441-efbdfc9f2872","year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.174109Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:1f998b9ee8ea3473a748348af398a3bc72635c2ae0e99f07c6fa472d567189c7","observation_id":"98ce7632-8fe1-4791-b08d-7151b3296e08","resolution":{"observed_at":"2026-08-14T10:25:10.169439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.149316Z","title":"Karpathy and L","venue":null,"work_id":"ed2aefb6-646f-4229-b243-3812258f3d21","year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.179211Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:6996568bc0f72b7a2bbfc06b4f18909a36404edde858cbea41bdc02cad974525","observation_id":"6385e889-997f-4bd5-8df8-0fd9cfb1519c","resolution":{"observed_at":"2026-08-14T10:25:10.154997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.184102Z","title":"Krizhevsky and G","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.184102Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:6c866b25f7efee06239e51c956ce05d63aa3b782d436a17f9e418f850cc5f66a","observation_id":"26acd71c-46e9-4ec7-8810-b33c532c47c8","resolution":{"observed_at":"2026-08-14T10:25:09.184102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.123209Z","title":"Krizhevsky, I","venue":null,"work_id":"64450d6b-c60c-4547-8e69-0744ac4bacb7","year":2012},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.191476Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:4cee9200b64378cd66c5fb0c05a87d7689abf9bc20fb90aa2268fd167701f4a5","observation_id":"5c0031ee-c8e7-426d-abf9-3e21d830b62b","resolution":{"observed_at":"2026-08-14T10:25:10.128739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.102982Z","title":"LeCun, Y","venue":null,"work_id":"4dfd5f71-60db-48e3-aed9-cfc2d4e5a7cd","year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.201615Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:c4f1a0fe09f7ef8add15dc74264de11b3d2c27fdc27c4fed9cede0b97c876266","observation_id":"096768c3-b2c1-4293-9a2f-5af88653751e","resolution":{"observed_at":"2026-08-14T10:25:10.107956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.084598Z","title":"LeCun, C","venue":null,"work_id":"de2022ba-7f71-436b-8c9a-26c352c3b753","year":1998},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.207250Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:a3c5817054c5021065546f09ae465cd1fa44564633401b18c74ae6de562e22a7","observation_id":"eb4e3404-d2db-4c34-a816-60481ff45074","resolution":{"observed_at":"2026-08-14T10:25:10.090331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.03009","last_updated":"2016-02-26T05:24:30Z","snapshot_observed_at":"2026-07-06T04:32:42.614338Z","submitted_at":"2015-10-11T04:32:39Z","title":"Neural Networks with Few Multiplications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.03009","snapshot_observed_at":"2026-08-14T10:25:09.212605Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.212605Z"},"links":{"cited_paper":"/paper/1510.03009","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:f20dd9fe4fa700b1335ec58aa22f5ec7737e4dae47e48d16a461fe56e810c70f","observation_id":"4ff0966c-ffa4-4eff-8628-93a305645783","resolution":{"observed_at":"2026-08-14T10:25:09.212605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.063511Z","title":null,"venue":null,"work_id":"4aa35036-a39c-4d76-8217-40fc824971b0","year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.218575Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:ae03371ecf91b4b119a267e473e692ca7dc97f3c1f74c3ab3b24b44ff32cd8ed","observation_id":"baed12f1-3649-4387-8cff-471d251c8d20","resolution":{"observed_at":"2026-08-14T10:25:10.068665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.08978","last_updated":"2017-02-01T04:09:31Z","snapshot_observed_at":"2026-08-14T21:18:43.111609Z","submitted_at":"2017-01-31T10:28:37Z","title":"Mixed Low-precision Deep Learning Inference using Dynamic Fixed Point","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.08978","snapshot_observed_at":"2026-08-14T10:25:09.223728Z","title":"Mellempudi, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.223728Z"},"links":{"cited_paper":"/paper/1701.08978","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:6544e34aa5a4bfacd321387c455b1e929bb5206fd82214ff85b59ab98154b960","observation_id":"3e860b22-0d7d-4a37-944d-5995976be45f","resolution":{"observed_at":"2026-08-14T10:25:09.223728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-14T10:25:09.229781Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.229781Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:d1d221e06e5caea9650ad13d2ce44a9f78173e201fef977b2a98ff250eeddcd7","observation_id":"f7a5da09-7f8d-4d52-be9b-e3612b8a4c17","resolution":{"observed_at":"2026-08-14T10:25:09.229781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.045044Z","title":"Pennington, R","venue":null,"work_id":"20f7bdb0-87ca-41c7-a8c4-6c998561741f","year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.235253Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:f6b73122f32bb510de7bd4532ebbc4654996b37d9628ea9e9aecb85214bea90b","observation_id":"07e2b768-28ac-4eaf-bd58-b875d0fd648a","resolution":{"observed_at":"2026-08-14T10:25:10.050224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.025628Z","title":"Rastegari, V","venue":null,"work_id":"15a644d6-55eb-482f-ad1d-6eb0b54fa6dd","year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.241030Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:f0ee3a8f5e544058a3294f84fef0bd88cac236e9da140cd616946b42237edccd","observation_id":"e1a7d630-7305-4124-88c3-5db6b6b142f0","resolution":{"observed_at":"2026-08-14T10:25:10.031652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.00485","last_updated":"2016-07-02T09:55:26Z","snapshot_observed_at":"2026-08-14T21:50:07.338917Z","submitted_at":"2016-07-02T09:55:26Z","title":"Group Sparse Regularization for Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1607.00485","doi":null,"metadata_source":"pith","pith_arxiv_id":"1607.00485","snapshot_observed_at":"2026-08-14T10:25:09.484650Z","title":"Group Sparse Regularization for Deep Neural Networks","venue":"stat.ML","work_id":"d77391e2-243b-44da-b2de-952c2f2101e2","year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.252331Z"},"links":{"cited_paper":"/paper/1607.00485","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:23051250db1e70bb54f2cf057ab3db1c1926d1c7f7592f43fb78f7d917f0945d","observation_id":"70e37374-8257-43e4-b0f2-32d6efada0a2","resolution":{"observed_at":"2026-08-14T10:25:09.494721Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:10.006220Z","title":"Schmidhuber","venue":null,"work_id":"7b7bafd8-9965-4b1a-b65c-d27026e3ee59","year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.263544Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:65d94d47fb3c0448e43cf29e1db426e1abc7e3e216a20a6fae54a767fd80c01f","observation_id":"8d64f728-190d-40b6-b824-c561a2a6f92f","resolution":{"observed_at":"2026-08-14T10:25:10.011326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.983497Z","title":"Silver, A","venue":null,"work_id":"c686b398-71a2-42d1-af65-19f9515870d1","year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.270468Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:16a26aaa28f2b0fe9ffb6c4aa47aab35bba23087a61289d3378136067219046a","observation_id":"20736198-9516-44c9-8812-cb841735dd25","resolution":{"observed_at":"2026-08-14T10:25:09.993135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-14T04:13:35.056640Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-14T10:25:09.277346Z","title":"Simonyan and A","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.277346Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:b0efda8367ed32f55bc0a2702068645c8d3634946ce09ea8098a7d49d7ffc34f","observation_id":"650a7974-c154-4025-bd52-beb765d93740","resolution":{"observed_at":"2026-08-14T10:25:09.277346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1507.06149","last_updated":"2015-07-22T12:18:21Z","snapshot_observed_at":"2026-07-06T04:24:33.642334Z","submitted_at":"2015-07-22T12:18:21Z","title":"Data-free parameter pruning for Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.06149","snapshot_observed_at":"2026-08-14T10:25:09.284215Z","title":"Srinivas and R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.284215Z"},"links":{"cited_paper":"/paper/1507.06149","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:6d65824632e080f5572a14b47c5e627eeb6d9b760cec4c698932c097dfd172f7","observation_id":"fc832cb5-4bdb-4bae-b543-c54021364079","resolution":{"observed_at":"2026-08-14T10:25:09.284215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06694","last_updated":"2016-11-21T09:24:24Z","snapshot_observed_at":"2026-08-14T21:29:29.077239Z","submitted_at":"2016-11-21T09:24:24Z","title":"Training Sparse Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06694","snapshot_observed_at":"2026-08-14T10:25:09.295317Z","title":"Srinivas, A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.295317Z"},"links":{"cited_paper":"/paper/1611.06694","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:be6789bfe9d09e0fc4a2af8389904b7bf3ec63f047b5590059adc164e13de46a","observation_id":"30a87c3f-716d-4a33-88c1-9e398403f81b","resolution":{"observed_at":"2026-08-14T10:25:09.295317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.962152Z","title":null,"venue":null,"work_id":"e75cf3ec-4ce5-40c5-9957-30ea59c131af","year":2015},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.301369Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:54c37db30dbdb46a93922dc0d719cf726081163ad86d9ec6e8a259cca6b7fdc3","observation_id":"4f2061d8-cf2c-426c-b945-046d0ae21b9e","resolution":{"observed_at":"2026-08-14T10:25:09.967439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.944398Z","title":null,"venue":null,"work_id":"14f0e076-8663-4f33-be3d-15bb1e4644c9","year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.306382Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:8e4e265eb4c4580cfb399872756659776aad0c9f35cf72da6758f64405646665","observation_id":"4f3213e7-4876-4274-bbb8-aff3c91d2a5d","resolution":{"observed_at":"2026-08-14T10:25:09.949003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.927864Z","title":"Sutskever, O","venue":null,"work_id":"b340c911-bb28-4643-bae6-c3debfd3f625","year":2014},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.310922Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:f762e65f4778616ab7eef23e9fd679fb73956acb4236fcba2d9b01c2334c242f","observation_id":"335ab8c2-dbd0-462d-80aa-be8c6b130d57","resolution":{"observed_at":"2026-08-14T10:25:09.933306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.0239","last_updated":"2015-02-21T16:58:39Z","snapshot_observed_at":"2026-08-12T00:32:31.696087Z","submitted_at":"2013-06-02T18:46:58Z","title":"Deep Learning using Linear Support Vector Machines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.0239","snapshot_observed_at":"2026-08-14T10:25:09.315744Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.315744Z"},"links":{"cited_paper":"/paper/1306.0239","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:ad9442839ab9aaf7bbc8611076cebe8e087d47ab36c3542718b75d34437d5026","observation_id":"802290e0-3b01-4af6-8af1-76c5b15b4a8b","resolution":{"observed_at":"2026-08-14T10:25:09.315744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.912599Z","title":null,"venue":null,"work_id":"0fd34089-e7ac-4e3e-8855-af3169edacf8","year":1998},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.320612Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:a106dc75731e30b7571d7b02d08beb29b71fe8edb56dec1ea478dc5dead4c0d9","observation_id":"0aebde66-429d-4033-8d1d-a55f7f748324","resolution":{"observed_at":"2026-08-14T10:25:09.917829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.04465","last_updated":"2017-11-25T09:15:28Z","snapshot_observed_at":"2026-08-14T21:20:55.848296Z","submitted_at":"2017-01-16T21:49:47Z","title":"The Incredible Shrinking Neural Network: New Perspectives on Learning Representations Through The Lens of Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.04465","snapshot_observed_at":"2026-08-14T10:25:09.325291Z","title":"Wolfe, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.325291Z"},"links":{"cited_paper":"/paper/1701.04465","citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:03bc79ffa707befb14d05f43dd98cdef2b81da8787590a279a77a9383af89d48","observation_id":"406ae157-120c-41d6-8ae9-fd0c6406414a","resolution":{"observed_at":"2026-08-14T10:25:09.325291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:25:09.895285Z","title":null,"venue":null,"work_id":"32b0e21c-ff8c-40fd-82cc-facec79837f9","year":2016},"citing_paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T10:25:09.332645Z"},"links":{"citing_paper":"/paper/1908.11250"},"observation_digest":"sha256:048f522850163b4878b636cb75a121e91c96155a0ebd755fe4160dd1739a5d35","observation_id":"49ebe41d-51df-440f-9b44-f93bc9c130e9","resolution":{"observed_at":"2026-08-14T10:25:09.900350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.11250","last_updated":"2019-08-29T14:17:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T21:00:03.805277Z","submitted_at":"2019-08-29T14:17:41Z","title":"Smaller Models, Better Generalization"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:1908.11250."}