{"as_of":"2026-08-21T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76b23d330250a2467742c3274ebb5c9fa1c626442d2f8245f9c0fc2389a931bb","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T22:10:15.970118Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.09287/citation-record","integrity":"/paper/2502.09287/integrity","json":"/paper/2502.09287/citation-record.json","paper":"/paper/2502.09287"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.01590","last_updated":"2024-03-31T14:31:14Z","snapshot_observed_at":"2026-08-16T14:13:18.547869Z","submitted_at":"2024-03-03T18:58:21Z","title":"The Hidden Attention of Mamba Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01590","snapshot_observed_at":"2026-08-07T22:10:15.869684Z","title":"The hidden attention of Mamba models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.869684Z"},"links":{"cited_paper":"/paper/2403.01590","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:f0a56a5f41fb595ef49caed4c05b2ac6c860949aae1405b088c33c4512d45048","observation_id":"91035583-e0b6-425c-8a0c-e8edfb12ee08","resolution":{"observed_at":"2026-08-07T22:10:15.869684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:10:16.299333Z","title":"We have the following equality: +∞X L=0 L|wl|2 = i 2π Z 2π 0 dW (ω) dω W (ω)dω","venue":null,"work_id":"52ef4715-c775-481a-93c5-9e14d040d56e","year":2017},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.952729Z"},"links":{"citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:516a0c0f2a9528263a9ab839312fef6d24cadf0704d427fa0a9aba685fc9644d","observation_id":"b5827925-3971-442c-9a96-390106c0129b","resolution":{"observed_at":"2026-08-07T22:10:16.303931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:10:16.283389Z","title":"The loss Ltime(c, d) writes Ltime(c, d) = 1 + +∞X k=0 |ck|2 − 2Re +∞X k=0 ckdk , where ck = PS s=1 ak s bs","venue":null,"work_id":"c0979fbf-64c7-42c1-a0da-2fcbc32d450a","year":2003},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.958930Z"},"links":{"citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:12ef3c088297aa81c59ac657834da9519ca2ebfc517459b41a373a6823c83a1c","observation_id":"7b14b8a1-92bd-41d2-b506-46f67cb8ad53","resolution":{"observed_at":"2026-08-07T22:10:16.288327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-08-18T21:12:50.808922Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-07T22:10:15.893978Z","title":"In-context learning and induction heads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.893978Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:a4f63a73f3273fbc50117846f02f716d8a1f064fb12af0cb971c1abe96d95781","observation_id":"a7cf5b77-e311-41f3-a804-2e779bb25e57","resolution":{"observed_at":"2026-08-07T22:10:15.893978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09871","last_updated":"2024-12-13T05:33:32Z","snapshot_observed_at":"2026-08-15T13:45:11.226724Z","submitted_at":"2024-12-13T05:33:32Z","title":"Byte Latent Transformer: Patches Scale Better Than Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09871","snapshot_observed_at":"2026-08-07T22:10:15.898992Z","title":"Byte latent transformer: Patches scale better than tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.898992Z"},"links":{"cited_paper":"/paper/2412.09871","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:42df712ef0cb60bea26979ab19aa6348de6f4fd861c80c7650db328d2be99c08","observation_id":"21f1b5c5-f89a-4c3c-a615-48294aef94ca","resolution":{"observed_at":"2026-08-07T22:10:15.898992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07904","last_updated":"2024-08-19T17:16:55Z","snapshot_observed_at":"2026-08-16T14:01:40.481918Z","submitted_at":"2024-04-11T16:43:03Z","title":"HGRN2: Gated Linear RNNs with State Expansion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07904","snapshot_observed_at":"2026-08-07T22:10:15.909661Z","title":"HGRN2: Gated linear RNNs with state expansion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.909661Z"},"links":{"cited_paper":"/paper/2404.07904","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:a1f549eb921977ef9be410f63ce8f84c05bad3c6770328d3f8597edc92e08878","observation_id":"1bd148f1-0b79-4d3e-b370-2b16168f3bca","resolution":{"observed_at":"2026-08-07T22:10:15.909661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14067","last_updated":"2024-10-31T10:38:47Z","snapshot_observed_at":"2026-08-19T03:34:40.831386Z","submitted_at":"2024-10-17T22:35:50Z","title":"Provable Benefits of Complex Parameterizations for Structured State Space Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14067","snapshot_observed_at":"2026-08-07T22:10:15.914320Z","title":"Provable benefits of complex parameterizations for structured state space models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.914320Z"},"links":{"cited_paper":"/paper/2410.14067","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:dfd732755431d2ea415441400fbaf3f1ecaea7589046a4d913ca03873ad2b642","observation_id":"8a1729de-bea0-4ad2-b717-173cf24fcef0","resolution":{"observed_at":"2026-08-07T22:10:15.914320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11135","last_updated":"2024-10-14T23:17:46Z","snapshot_observed_at":"2026-08-20T22:03:32.255678Z","submitted_at":"2024-10-14T23:17:46Z","title":"Mimetic Initialization Helps State Space Models Learn to Recall","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11135","snapshot_observed_at":"2026-08-07T22:10:15.924424Z","title":"Mimetic initialization helps state space models learn to recall.arXiv preprint arXiv:2410.11135,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.924424Z"},"links":{"cited_paper":"/paper/2410.11135","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:ed32d9d9bcbd477b497a6a7b841435933bdaa2aa2b296d51a14e7978b9c2ec7e","observation_id":"4cd7186e-8082-4322-a602-6b3ba074244d","resolution":{"observed_at":"2026-08-07T22:10:15.924424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T22:10:15.936398Z","title":"Li, Madian Khabsa, Han Fang, and Hao Ma","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.936398Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:a8779aecc798e6a839c9ec112038b41125f619c363663e8c028e6459c35e21f1","observation_id":"aada7242-859b-493d-97dc-367f16401d11","resolution":{"observed_at":"2026-08-07T22:10:15.936398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06484","last_updated":"2025-01-15T10:41:40Z","snapshot_observed_at":"2026-08-16T13:44:27.642787Z","submitted_at":"2024-06-10T17:24:42Z","title":"Parallelizing Linear Transformers with the Delta Rule over Sequence Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06484","snapshot_observed_at":"2026-08-07T22:10:15.942223Z","title":"Gated linear at- tention transformers with hardware-efficient training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.942223Z"},"links":{"cited_paper":"/paper/2406.06484","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:cb325a400a79ed7056c0d10b9f97bfa96f2018b79ee3c432ff9746070a706bf6","observation_id":"d4861c86-2a08-49fc-a7d7-aec6e08425eb","resolution":{"observed_at":"2026-08-07T22:10:15.942223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:10:16.314439Z","title":"In particular it fully describes a linear time-invariant system","venue":null,"work_id":"ef7f4b4c-e6a2-4fe6-8768-29da8bff1dbc","year":1996},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.947554Z"},"links":{"citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:6bf3c8637da69cc1407bf185f6093663e1c09e2375725b5723ddf63acb02234b","observation_id":"4c146fea-16db-43d5-8311-454c600a4fe0","resolution":{"observed_at":"2026-08-07T22:10:16.318990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:10:16.266346Z","title":null,"venue":null,"work_id":"e01b2838-b2b0-4c7b-a555-d1647dce868b","year":2006},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.964420Z"},"links":{"citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:44c91071c261a79e0043f12fe451fb558445d651fb21af89fbfd651bfd755223","observation_id":"bcd3a544-33af-4ab6-94df-9183db172ee6","resolution":{"observed_at":"2026-08-07T22:10:16.271485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T22:10:16.246287Z","title":"bu = e−α(e2α−e−2α) 2Kinit × (−1)u bu = e−α(e2α−e−2α) 2Kinit × (−1)u α 1 1 Kinit 1300 1300 Number epochs 60 60 Table E.1: Experimental details for Figure 4 (left)","venue":null,"work_id":"7f90912b-1a59-4af0-94b2-25bc3a577111","year":2000},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.970118Z"},"links":{"citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:5660fd0b9ab75fac4537668f80b51db7bb63a8e13171dd4d8cb04bc642ba0d56","observation_id":"69e8d9a6-0ab4-484e-816b-6a80ff987558","resolution":{"observed_at":"2026-08-07T22:10:16.253661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06174","last_updated":"2016-04-22T19:21:36Z","snapshot_observed_at":"2026-08-14T14:33:36.303679Z","submitted_at":"2016-04-21T04:15:27Z","title":"Training Deep Nets with Sublinear Memory Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.06174","snapshot_observed_at":"2026-08-07T22:10:15.875426Z","title":"Training deep nets with sublinear memory cost","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.875426Z"},"links":{"cited_paper":"/paper/1604.06174","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:a89da60f1ac744a1b803ac3ad305844be7ae5afe0e98f58868ee7e873e0d6f50","observation_id":"0a45fa97-2ece-42ec-b781-1eed4021434c","resolution":{"observed_at":"2026-08-07T22:10:15.875426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05892","last_updated":"2024-09-26T22:39:08Z","snapshot_observed_at":"2026-08-12T16:03:56.235250Z","submitted_at":"2024-04-08T22:20:59Z","title":"Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05892","snapshot_observed_at":"2026-08-07T22:10:15.904632Z","title":"Eagle and Finch: RWKV with matrix-valued states and dynamic recurrence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.904632Z"},"links":{"cited_paper":"/paper/2404.05892","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:a4f249064d1fd6f8292d2d4e2b7eb6ed8d1876d9ee6ca640f0f86d61d99c69bd","observation_id":"009fcbbb-28da-403e-80c2-4625f72bce77","resolution":{"observed_at":"2026-08-07T22:10:15.904632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07887","last_updated":"2024-06-12T05:25:15Z","snapshot_observed_at":"2026-07-06T18:29:21.709395Z","submitted_at":"2024-06-12T05:25:15Z","title":"An Empirical Study of Mamba-based Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07887","snapshot_observed_at":"2026-08-07T22:10:15.930676Z","title":"An empirical study of Mamba-based language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.930676Z"},"links":{"cited_paper":"/paper/2406.07887","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:5040252d1eb748627547216b15261b47f0e0f2e4a43f516b8683bdc918593d31","observation_id":"d35879dc-01b4-4d26-ab0a-002583bd32b3","resolution":{"observed_at":"2026-08-07T22:10:15.930676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T22:10:15.919445Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.919445Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:e8b48ef7e04b84be814ca4fd37a7bf6b4bea28750e5e039a0bcbf108aab145e3","observation_id":"236f1407-e774-4ba7-8909-4d3f38801392","resolution":{"observed_at":"2026-08-07T22:10:15.919445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19427","last_updated":"2024-02-29T18:24:46Z","snapshot_observed_at":"2026-08-20T11:13:49.127921Z","submitted_at":"2024-02-29T18:24:46Z","title":"Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19427","snapshot_observed_at":"2026-08-07T22:10:15.888345Z","title":"Smith, Anushan Fernando, Aleksandar Botev, George Cristian-Muraru, Albert Gu, Ruba Haroun, Leonard Berrada, Yutian Chen, Srivatsan Srinivasan, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.888345Z"},"links":{"cited_paper":"/paper/2402.19427","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:23729d09ead72c070ac9c2fb9439cace9a7941fc808b124f8f08fb2c0733cb86","observation_id":"b16394b4-5d9a-4a44-8eae-af6350b2a513","resolution":{"observed_at":"2026-08-07T22:10:15.888345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T22:10:15.881607Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T22:10:15.881607Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2502.09287"},"observation_digest":"sha256:2cb2d903aaeb13cb3e6199b0d1b447b3fe47cf3ebcfa608b579ef4adac8a738e","observation_id":"3631dce4-a96e-4364-9fea-7e859e6418f1","resolution":{"observed_at":"2026-08-07T22:10:15.881607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.09287","last_updated":"2025-02-13T13:01:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T09:02:51.260792Z","submitted_at":"2025-02-13T13:01:46Z","title":"An Uncertainty Principle for Linear Recurrent Neural Networks"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2502.09287."}