{"as_of":"2026-08-10T13:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c944094bb5e71b0702f2c63896348c4793746f3ae8d1152f000ab78d91cf1bd","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T01:13:15.449012Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.18012/citation-record","integrity":"/paper/2501.18012/integrity","json":"/paper/2501.18012/citation-record.json","paper":"/paper/2501.18012"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:32.682440Z","title":"This requires careful design of differentiable transitions between network sizes","venue":null,"work_id":"7a5c977f-8760-4b54-a78e-0f9301ec70be","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.107137Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:f559279f9c9a588c82d0d4952054570734c302b30069723e4d4fa87ebe44db2b","observation_id":"8f71e704-cfa5-4834-bd9b-3f6242bbbded","resolution":{"observed_at":"2026-08-10T01:13:32.710736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:32.464644Z","title":"Both approaches require a smooth transition function ψ(x) that approximates a step function while maintain- ing differentiability","venue":null,"work_id":"aaad63fc-8f38-446c-8e2f-8819cdc50c6c","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.115278Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:6c392fb4bbee025d2d53e11cd1d84af364b9cc5862adf5dfd50f0b8f65afb38a","observation_id":"5fd71507-d9e8-4b84-8122-db67ad8b2765","resolution":{"observed_at":"2026-08-10T01:13:32.569436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:32.363973Z","title":"on” (white squares), one partially “on","venue":null,"work_id":"134cd7d3-e3ae-419f-84f2-72ccd8d1fd0b","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.122000Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:5074713171b6b391142895160a3955fafc75d556a5317ec1985f03598989aa22","observation_id":"cc4cfd25-6b6c-43c5-8ebc-2beaab720887","resolution":{"observed_at":"2026-08-10T01:13:32.369330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:32.339434Z","title":null,"venue":null,"work_id":"fa2b2bec-46e2-466e-8847-5357ea05636a","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.128018Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:ac838235aa4bf8fbd36f10478f66e089267de23668a3d4b38497be9d09de655e","observation_id":"bb4d4a92-a679-4c96-aeb3-e3a5fb91079b","resolution":{"observed_at":"2026-08-10T01:13:32.346994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:32.297405Z","title":null,"venue":null,"work_id":"33966443-52d2-48ca-ad19-1a9c15f317b2","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.134932Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:cbb736e994f2222bec586523abca795181932f654f850b1917b6e4ee93920aef","observation_id":"735cce40-5449-4849-9c94-6d544eb1a496","resolution":{"observed_at":"2026-08-10T01:13:32.325820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:32.144212Z","title":null,"venue":null,"work_id":"3462165d-5382-4ae6-9e92-64d25e8dddbd","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.140581Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:b74f43cf0a1b0b5dcdd0e15405faf3b8415c00d6f6c11e9487a4edf7505cc93f","observation_id":"87b67cd6-caaa-4709-93e6-3032eee4c827","resolution":{"observed_at":"2026-08-10T01:13:32.244149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.987623Z","title":null,"venue":null,"work_id":"116de6c5-41c3-4d66-bc34-b551b9ddaf2b","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.160146Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:cbebf07e2556a71bffa74f3e17e441413101068262753bbb628a1c2126f8b80f","observation_id":"d7b29cae-d710-444f-ba26-09f20789fdd1","resolution":{"observed_at":"2026-08-10T01:13:32.022749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.433458Z","title":null,"venue":null,"work_id":"bfa89b0e-cc45-4c81-a5f3-0fd185c5c199","year":2004},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.283933Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:8bad1d3dd139e12a1f408f553fadfa8b9b7bcb01b1326dbf9ff78b127f760daa","observation_id":"4f394f5f-dba0-48dc-9c9b-505cec9709e1","resolution":{"observed_at":"2026-08-10T01:13:31.483211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.780108Z","title":null,"venue":null,"work_id":"4dbc8f08-c05e-443a-9b67-4cd6884affd7","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.175177Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:3a4d64a35d045284ea71cc66e4761e2f44a2cce07cc3d1d1361e1241be148b89","observation_id":"6f581d36-34de-4a91-ac02-6c06dd59d7fb","resolution":{"observed_at":"2026-08-10T01:13:31.830410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.716033Z","title":null,"venue":null,"work_id":"f70f1949-44bd-4020-b623-98f451c3a2c8","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.182841Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:1e558479b112efa96cfb8564d22f5adf4321a58f70da98b6d880f5a60d61d6e9","observation_id":"df6d7c43-ba29-4ed7-a92c-2e695e0310bb","resolution":{"observed_at":"2026-08-10T01:13:31.721664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.904652Z","title":"This technique of using an auxiliary weight to set neural network constraints was first used by Jin et al","venue":null,"work_id":"ac1ce771-41c6-4998-8238-5919bcc5767e","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.168257Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:c91c0642d7b029a883c51c6f74aa2a4f5185bf2931eca7fb0c1a058afd12183a","observation_id":"05fe98ef-4d24-4219-8a99-0107b7f13370","resolution":{"observed_at":"2026-08-10T01:13:31.972985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.696419Z","title":null,"venue":null,"work_id":"40d22fdb-b8dc-408c-b265-ddcbc4009993","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.190550Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:4422aa4d2159bae5a1b39024b151078f74ad420737c55585280410ad9503be22","observation_id":"ed5b0959-c034-4659-b951-745e7bfe25ed","resolution":{"observed_at":"2026-08-10T01:13:31.703197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.679384Z","title":"(22) As N increases, new neurons smoothly activate and join the computation, as shown in figure 1","venue":null,"work_id":"27e8e388-0384-4032-8671-3840794b486d","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.197090Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:136b8bb81bc4f5c671a8efb7ada6f00cd2ffaab68bedc09c709703ac4293e393","observation_id":"ad7e9ca8-22eb-46eb-be38-e67fc766fe3d","resolution":{"observed_at":"2026-08-10T01:13:31.685774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.659442Z","title":null,"venue":null,"work_id":"bc93459a-876e-4734-a8fc-b988d49a413e","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.212095Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:22a706aef9e199561d9c50a148bccc29008bd078511e2b76ad4d9c88098f9338","observation_id":"12484037-2b64-47d7-8c0b-83445a1003d1","resolution":{"observed_at":"2026-08-10T01:13:31.665164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.641192Z","title":"bigger is better","venue":null,"work_id":"ef08ca0a-f40f-4821-9c9c-d0b9b7485e77","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.223769Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:8a70cae95113520fdf2fef8a141c72e0337b536da679a8bb093d900fae1e7c96","observation_id":"f96bc5ee-0804-4b00-a403-7afcb0152d0b","resolution":{"observed_at":"2026-08-10T01:13:31.646948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-10T01:13:15.230609Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.230609Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:b6d008218f8c033a1d76024b3dcba68ae6928643d07fdbf416988482fa94a82d","observation_id":"3dce20bf-a6f3-4203-8e31-0b7fd9aaf11d","resolution":{"observed_at":"2026-08-10T01:13:15.230609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02243","last_updated":"2019-06-05T18:40:53Z","snapshot_observed_at":"2026-08-08T05:13:40.118908Z","submitted_at":"2019-06-05T18:40:53Z","title":"Energy and Policy Considerations for Deep Learning in NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02243","snapshot_observed_at":"2026-08-10T01:13:15.237816Z","title":"Strubell, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.237816Z"},"links":{"cited_paper":"/paper/1906.02243","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:55b899948fce6e10cbc72105c3eb81aa927523a511c499ea2a2896b2fade753e","observation_id":"11d52dd7-1975-4382-8c40-fc232c9599a0","resolution":{"observed_at":"2026-08-10T01:13:15.237816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.622979Z","title":"Ai and compute,","venue":null,"work_id":"5fa9f156-0ca3-4eac-8334-cd3c57fa20da","year":2018},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.244249Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:5c2ad755e71b057d841ba94fcc39a7685ca9fdf3cebd096e27fd2854a18f6f13","observation_id":"9c12a7aa-e4ac-4ff8-b168-067ac940b242","resolution":{"observed_at":"2026-08-10T01:13:31.628847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-10T01:13:15.250799Z","title":"Frankle and M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.250799Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:87da8fc1e072404148f4ebe9a10f5ca8b303c1f2979653cbd9cf59506cfeb0d9","observation_id":"f4752ad8-341a-471a-86f7-0115620aabb8","resolution":{"observed_at":"2026-08-10T01:13:15.250799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.09274","last_updated":"2016-06-29T20:36:23Z","snapshot_observed_at":"2026-08-08T23:05:07.027492Z","submitted_at":"2016-06-29T20:36:23Z","title":"Compression of Neural Machine Translation Models via Pruning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.09274","snapshot_observed_at":"2026-08-10T01:13:15.258005Z","title":"See, M.-T","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.258005Z"},"links":{"cited_paper":"/paper/1606.09274","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:91582525db73dc07a064b450217d3d56e9ddd559ca532bf9c988fcb02fbccab1","observation_id":"ab07f22f-8929-4368-8702-a9837140da90","resolution":{"observed_at":"2026-08-10T01:13:15.258005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.563600Z","title":null,"venue":null,"work_id":"2efaf445-fa50-47bb-b177-6fdc240cdc05","year":2024},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.264430Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:964a5cb0d840818b13dc1aa6febd6b285e599b0608a1309778a5fd68674f6a4d","observation_id":"574ca022-04ec-4e1a-b9e4-6899a6f436b7","resolution":{"observed_at":"2026-08-10T01:13:31.610957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.12200","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:30.826121Z","title":null,"venue":null,"work_id":"ab575bff-04ff-40b4-8603-5029f8fae1a0","year":2023},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.273845Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:f703ed3349ab6a0d68b0de22116637ad01ec2c41d96eabac4e4373b77c514a76","observation_id":"620c0fe3-900d-4f4d-999b-84f00d547ee8","resolution":{"observed_at":"2026-08-10T01:13:30.845632Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/2601412","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Aggarwal and K","venue":"ACM Computing Surveys","work_id":"f83996d7-46e4-4d17-9f0e-3f65e9e5996f","year":2014},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.289709Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:5b362a1e075f1b6029bbbd8eebe7a8a1d4012cbb812af222730ffa84ced34800","observation_id":"4e3cc05a-9d30-47b8-870c-996b9c033183","resolution":{"observed_at":"2026-08-10T01:13:15.544228Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physreve.90.022801","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Tunc and L","venue":"Physical Review E","work_id":"0f19b3b1-7508-4a52-a606-37d092abf855","year":2014},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.296521Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:1a505b7d7eff7e4be2f7d6ad12dd174e75f3c4e4a5f3aa14873a7e25f9efae7f","observation_id":"504225b2-0626-4531-81ae-6e625b651399","resolution":{"observed_at":"2026-08-10T01:13:15.509965Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.05377","last_updated":"2019-04-26T09:50:47Z","snapshot_observed_at":"2026-07-06T06:55:54.705302Z","submitted_at":"2018-08-16T08:45:01Z","title":"Neural Architecture Search: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.05377","snapshot_observed_at":"2026-08-10T01:13:15.304999Z","title":"Elsken, J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.304999Z"},"links":{"cited_paper":"/paper/1808.05377","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:7064ecae3bab7d818ecde1fae773fba141b7a35805c97ba01e10e34a2f9f4c3f","observation_id":"1d958f3a-2779-4464-9c4f-ff6a41bbcaee","resolution":{"observed_at":"2026-08-10T01:13:15.304999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.03033","last_updated":"2020-03-06T05:06:12Z","snapshot_observed_at":"2026-08-07T07:38:33.089333Z","submitted_at":"2020-03-06T05:06:12Z","title":"What is the State of Neural Network Pruning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.03033","snapshot_observed_at":"2026-08-10T01:13:15.312961Z","title":"Blalock, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.312961Z"},"links":{"cited_paper":"/paper/2003.03033","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:4a0863c6bd7f71c714d4d57cb8fc53a34fdd2cf1d18b9b04f9e88d1d3e7689ee","observation_id":"f6ab3b8b-d180-4a93-9bc0-da25697fcb31","resolution":{"observed_at":"2026-08-10T01:13:15.312961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.293051Z","title":null,"venue":null,"work_id":"6921594f-cbcd-4c28-b3c1-c7c2b28d6316","year":2002},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.319361Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:b4a1dfdb6e2ec43a549c596dade99745290fe617bb9f63e777589460a7d5b8b9","observation_id":"3adb772e-d5b9-4c63-99ab-1bf3b7bfc1b5","resolution":{"observed_at":"2026-08-10T01:13:31.350495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.273598Z","title":"Fahlman and C","venue":null,"work_id":"5a59ce3a-6717-4530-ad88-abaa8877ba9e","year":1989},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.325612Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:21a8f4d360359b2f17778d7aacaf0df3c43aa62d7d058756fed59ee03523f87d","observation_id":"eb8090b1-77ca-4e79-a11b-13f7835d773b","resolution":{"observed_at":"2026-08-10T01:13:31.278990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.04838","last_updated":"2018-02-08T20:40:22Z","snapshot_observed_at":"2026-08-09T09:43:11.255145Z","submitted_at":"2016-06-15T16:15:53Z","title":"Optimization Methods for Large-Scale Machine Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.04838","snapshot_observed_at":"2026-08-10T01:13:15.331410Z","title":"Bottou, F","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.331410Z"},"links":{"cited_paper":"/paper/1606.04838","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:c7e4efe01826a93472f895d4ec280530df3a0a2b83ed653934ca0b1b5031d7cf","observation_id":"de83aef9-a7b7-4be6-8cf2-5f02b53f3068","resolution":{"observed_at":"2026-08-10T01:13:15.331410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.241417Z","title":"Allen-Zhu, Y","venue":null,"work_id":"0ac7ef16-2938-43a7-b67a-c3f82ab764cf","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.339183Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:3c6a01100cca51bbdcf0abc2d7f2ad06368d515c2511f89c3394ea7023dc11f1","observation_id":"5905fdaf-88ae-4c47-bc79-8c1bdf762871","resolution":{"observed_at":"2026-08-10T01:13:31.249463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1309.5549","last_updated":"2013-09-22T01:35:43Z","snapshot_observed_at":"2026-07-06T03:23:37.989040Z","submitted_at":"2013-09-22T01:35:43Z","title":"Stochastic First- and Zeroth-order Methods for Nonconvex Stochastic Programming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1309.5549","snapshot_observed_at":"2026-08-10T01:13:15.347461Z","title":"Ghadimi and G","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.347461Z"},"links":{"cited_paper":"/paper/1309.5549","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:d3abadb39a54a97fc3c23b493bd937647e154bc7eed2e7dfc1f3cb2ae8846115","observation_id":"8d72bf8a-4bbf-41de-b861-2ad8af6182fc","resolution":{"observed_at":"2026-08-10T01:13:15.347461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04326","last_updated":"2020-02-21T04:48:07Z","snapshot_observed_at":"2026-08-09T01:00:45.702375Z","submitted_at":"2019-04-08T19:43:09Z","title":"A Comparative Analysis of the Optimization and Generalization Property of Two-layer Neural Network and Random Feature Models Under Gradient Descent Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.04326","snapshot_observed_at":"2026-08-10T01:13:15.355179Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.355179Z"},"links":{"cited_paper":"/paper/1904.04326","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:b631de2c48cc07cb16507f982419e3fcd0b248a169b93b43e021e40d669e35f2","observation_id":"b716871e-5b7c-4718-bcdc-76d2667bb706","resolution":{"observed_at":"2026-08-10T01:13:15.355179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.00451","last_updated":"2022-02-24T18:29:39Z","snapshot_observed_at":"2026-08-09T13:12:27.433306Z","submitted_at":"2022-02-24T18:29:39Z","title":"Physics-Informed Neural Networks for Quantum Eigenvalue Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00451","snapshot_observed_at":"2026-08-10T01:13:15.362660Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.362660Z"},"links":{"cited_paper":"/paper/2203.00451","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:a4e1086c07989be6b43d30c0a5e70e1b172030fb71b0a7d8436c906f4277851a","observation_id":"50a180f8-3ef6-4a0a-b26c-05ecb0fd1365","resolution":{"observed_at":"2026-08-10T01:13:15.362660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.223216Z","title":"Wolfram Research, Inc., Mathematica,","venue":null,"work_id":"b9a62c97-16cb-4974-88d7-98a93f1d33f6","year":2024},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.377448Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:53bc9fbb8cd1fe1f8e84da9a8dc907c54d81982afdf4962eed9199fda7a899e5","observation_id":"c485027d-ad7c-4ac8-af18-1fa0e02225a9","resolution":{"observed_at":"2026-08-10T01:13:31.229083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:15.387268Z","title":"JAX: com- posable transformations of Python+NumPy programs,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.387268Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:af24d908b3bda9d5470c56bd7e9bae369b1e27f4dc0f690e66d22f7bd12f939e","observation_id":"c1e3d931-58ec-4fa4-bbe0-6bcdbfb81696","resolution":{"observed_at":"2026-08-10T01:13:15.387268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:15.395527Z","title":"Kidger and C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.395527Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:5f13d9720d4ad12740efebb4fb228543b3d4bd6bed1df0948582c986b66a8770","observation_id":"053d1113-7261-4851-ae80-245695dfb549","resolution":{"observed_at":"2026-08-10T01:13:15.395527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:15.404568Z","title":"The DeepMind JAX Ecosystem,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.404568Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:58799efa6daa7a22d74f22651f2636b241eb304a28e3997656e1b6a19c488121","observation_id":"5a634493-ee1f-4d96-9ea5-375b2f0f8a70","resolution":{"observed_at":"2026-08-10T01:13:15.404568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:31.015834Z","title":null,"venue":null,"work_id":"7ac02548-6980-4d3f-adf0-ac7640d481fe","year":null},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.412339Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:3a2873fc8c49b2297b2c8dc4957c76deef300446fcfe6ccecd4ccfa9a94c33b6","observation_id":"2b8022d9-cec7-484f-8e71-5f1af4a297a2","resolution":{"observed_at":"2026-08-10T01:13:31.097235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:30.964886Z","title":null,"venue":null,"work_id":"b188a6eb-a78d-48f6-bf49-fdec99ef547a","year":2007},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.422978Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:320f12bf834d93f7d54eeecbb5d80f0d83c3df458af528905a3e29e3da2ba0bd","observation_id":"000914fe-30b4-4d89-9c36-2c22c4b9de7f","resolution":{"observed_at":"2026-08-10T01:13:30.970973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T01:13:30.945368Z","title":"Sarao Mannelli, Y","venue":null,"work_id":"3cd4cb1e-afff-4373-bcb2-0bee30712f5c","year":2024},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.430806Z"},"links":{"citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:64b4a8ff0e6a4a2491f0f0535425045bc39f6f5626577ff95fcb3727934afc6e","observation_id":"a72cd15a-0736-445f-8236-703e35d861cd","resolution":{"observed_at":"2026-08-10T01:13:30.950682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14160","last_updated":"2025-03-01T12:02:55Z","snapshot_observed_at":"2026-08-09T16:06:55.397757Z","submitted_at":"2024-09-21T14:43:54Z","title":"Hype, Sustainability, and the Price of the Bigger-is-Better Paradigm in AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14160","snapshot_observed_at":"2026-08-10T01:13:15.440696Z","title":"Varoquaux, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.440696Z"},"links":{"cited_paper":"/paper/2409.14160","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:99a79cffbc9a1eec9952042ec2629fa10d10bb64053db7d3ca9f34e8848bc8e1","observation_id":"d368004d-aecc-4120-8bf5-55451a16e8de","resolution":{"observed_at":"2026-08-10T01:13:15.440696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05125","last_updated":"2022-06-07T15:29:01Z","snapshot_observed_at":"2026-08-07T08:07:45.534113Z","submitted_at":"2022-01-13T18:30:18Z","title":"GradMax: Growing Neural Networks using Gradient Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.05125","snapshot_observed_at":"2026-08-10T01:13:15.449012Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T01:13:15.449012Z"},"links":{"cited_paper":"/paper/2201.05125","citing_paper":"/paper/2501.18012"},"observation_digest":"sha256:12288f04f3504bac6a01bcf5a6a13681e5d4e48cb558c8a752ef409dc0b69524","observation_id":"18ab6f87-14c5-48b3-94e2-cd7596422772","resolution":{"observed_at":"2026-08-10T01:13:15.449012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.18012","last_updated":"2025-07-25T20:18:00Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T11:00:14.796714Z","submitted_at":"2025-01-29T21:56:38Z","title":"Growing Neural Networks: Dynamic Evolution through Gradient Descent"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":11},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2501.18012."}