{"as_of":"2026-08-09T18:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3bd18277decb8c1a4c87d977b4dc4edad6b0e849987ef2775e9d015d9237dd6","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T04:33:35.163697Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03148/citation-record","integrity":"/paper/2607.03148/integrity","json":"/paper/2607.03148/citation-record.json","paper":"/paper/2607.03148"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1412.6830","last_updated":"2015-04-21T08:05:02Z","snapshot_observed_at":"2026-08-08T10:22:07.293115Z","submitted_at":"2014-12-21T20:20:21Z","title":"Learning Activation Functions to Improve Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6830","snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Learning Activation Functions to Improve Deep Neural Networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"cited_paper":"/paper/1412.6830","citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:bbd7abb64e67fa85fcc7e1064ba6875a4d24ed98f44735ac47f858165de8eacb","observation_id":"5b5436f0-8d91-4eb7-b691-8803cce259d2","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Training Stochastic Model Recognition Algorithms as Networks can Lead to Maximum Mutual Information Estimation of Parameters","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:6b453cde03cefa477376fd5fc63fa5f9ca9cce489949897d962f86edad07f41f","observation_id":"781d29f4-3b1d-475d-80c9-47ee7df91e61","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/isca.2016.13","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PRIME: A Novel Processing-in-Memory Architecture for Neural Network Computation in ReRAM-Based Main Memory","venue":null,"work_id":"d72ac7fd-eb07-4b5c-a6ae-16da6dcfb991","year":2016},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:8f07cafb225f66d2d0c0c7d6d0825f559fdc49d4a061af6d71537ed650f729ab","observation_id":"04da861e-8ff4-477a-ba3a-19d7be97c880","resolution":{"observed_at":"2026-07-12T04:38:28.800622Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-13T20:50:18.431876+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T20:50:18.431876+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07289","last_updated":"2016-02-22T07:02:58Z","snapshot_observed_at":"2026-07-06T04:37:28.029641Z","submitted_at":"2015-11-23T15:58:05Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07289","snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"cited_paper":"/paper/1511.07289","citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:5180e205b73dd80d3bea4ca1df56b497734bda52af421117ef55a6d7c75310ad","observation_id":"57122c4a-4ccf-4948-92c0-7ffda737ac00","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Maxout Networks","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:3c2bb92157a927f15c89a24b82af89c582cdf73ac12c3390ceabc6f938fb4286","observation_id":"20d8910d-b851-43f5-b1ad-6ded3fd0b200","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"On the Impact of the Activation func- tion on Deep Neural Networks Training","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:bf3a7a0074d32ef37ccfdbab59542a874996aec038f1e488868162b91a2173f7","observation_id":"2e3963c0-e020-422b-a9ca-6b0ccc2742ff","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Delving Deep into Rectifiers: Surpassing Human-Level Performance on ImageNet Classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:372d1928f10a6bb1bc22af170616de5a04d68f345bdc6fc8b251342104785062","observation_id":"4d03bc0f-44e0-41fb-8d64-e7644109af5d","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Gaussian Error Linear Units (GELUs)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:b47d4a78c193afcad6af59e65c934afccaffbac63d953ba9e09ad2b4378dff03","observation_id":"972e1884-2f19-4e46-aa20-08b9045aeb10","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Curvature Tuning: Provable Training- free Model Steering From a Single Parameter","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:5bcb04c4d432f1b1cf711c3d4a3073870fc4f997caf3485647c6d8d6406530e9","observation_id":"da280fd5-a8c6-4acb-a55a-950b1edce5a8","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"In-Memory Computing with Resistive Switching Devices","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:292d7b06f2a0fbcbbaea835abb9eb45be4d4a1c83bbfc1988fac56a6d2cb3611","observation_id":"6a3bcf62-47d3-4677-a52c-b519eff7ec65","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:aa14e63e6f9817180b49611910090e3b1507d77e48a54c2681f92ab7ec60f004","observation_id":"1246c2e0-cc30-4ad5-ac37-4de875c9962a","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Analog In-Memory Computing Attention Mechanism for Fast and Energy-Efficient Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:dc27c397de8cc8ad03f1114612eb1f1185a5557ff2e848c9921bbb520e22a958","observation_id":"bf2f3223-a83d-4d95-a426-1de956a38019","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"KAN: Kolmogorov-Arnold Networks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:af4322bffeea7f80d6bb9e5f6f500d0f3556e243de315c63882f3cdf9ae982bc","observation_id":"f3411697-8fe9-474c-92b7-72ece09ce67d","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Rectifier Nonlinearities Improve Neural Network Acoustic Models","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:7f6a1452f6e3b36d0f3bb901ee990949bd21a0a44afa5968562513a138a8bf56","observation_id":"9b529d5b-6147-4381-b6b0-492a4eee5144","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08681","last_updated":"2020-08-13T05:42:12Z","snapshot_observed_at":"2026-07-06T08:16:16.271286Z","submitted_at":"2019-08-23T06:22:06Z","title":"Mish: A Self Regularized Non-Monotonic Activation Function","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08681","snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Mish: A Self Regularized Non-Monotonic Activation Function","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"cited_paper":"/paper/1908.08681","citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:b7d9e70e1e7e9300e22486843eb6e97cca7dfec1928e6a845e94dba71c2593ce","observation_id":"c52b5bbe-8036-4dd4-b1b0-3117424f4b0e","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Padé Activation Units: End- to-end Learning of Flexible Activation Functions in Deep Networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:16260e10bdbea7f12ab4dd840d8de03095e8459dec2627128ea628c159ebec38","observation_id":"45791a63-a9b6-45bb-a29e-1301714dfc7d","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Rectified Linear Units Improve Restricted Boltzmann Machines","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:cb92e4d70150b15220a76282a465c9ec92436db6ac5cf61bca77c774f941ef3a","observation_id":"f216dc78-e164-4437-8fe5-c63bb8c8f616","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Training and Operation of an Integrated Neuromorphic Network Based on Metal-Oxide Memristors","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:85c6ef22f22e6b025288079d767bbbfe679e40fa6b76a2ee72d24da92f3a696c","observation_id":"b868710e-78c6-4397-921e-5785eb20a59c","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Searching for Activation Functions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:d7873d0d9ce388ef6a6858e6611427d881f1f4be206391d1db33ad2c89520e80","observation_id":"c8996269-1715-46e2-a363-fc684b96d751","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"ImageNet Large Scale Visual Recognition Challenge","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:31896337cdb042077d687c0aa2bf16076eb0cd5c315e43abb99808ce3a880549","observation_id":"40a1d3ad-2002-4a24-98a0-9cfbea1fd29a","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Memory Devices and Applications for In-Memory Computing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:9cb308e24718effe8c015e0543a0e7a44789f5767ea49b90645ccb26f7ed2ab5","observation_id":"3de00180-1532-4e79-8434-35482e2c269f","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"ISAAC: A Convolutional Neural Network Accelerator with In-Situ Ana- log Arithmetic in Crossbars","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:c7e7919a44538589540acaac2e35d7a9df18841397967a8470c6212938978188","observation_id":"397c1aef-cd72-451e-b718-371f5b176886","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"GLU Variants Improve Transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:4c382b13dcefcd0ab984a037a2be72e858e91e6abe094d2ae60147d27d6e0182","observation_id":"22c1e60f-0a01-475b-934d-6345d37c5bbb","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture- of-Experts Layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:71b10510c8357e0f419ccc6f9e31b38ad710398e2ef13158007409d7435b6e4f","observation_id":"90f272d1-b3be-424f-91fe-722c74c2988c","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:33:35.163697Z","title":"Training Very Deep Net- works","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T04:33:35.163697Z"},"links":{"citing_paper":"/paper/2607.03148"},"observation_digest":"sha256:c8d8b318e7e792d068f27c821965a71dddef208fed36aa4f2c99a3009ef84205","observation_id":"5d43d356-2425-4eec-ac55-fc56c7ec4d1f","resolution":{"observed_at":"2026-07-12T04:33:35.163697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03148","last_updated":"2026-07-03T09:38:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T09:26:22.358496Z","submitted_at":"2026-07-03T09:38:16Z","title":"Rethinking Neural Nonlinearity as Gating"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":5,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.03148."}