{"as_of":"2026-08-13T22:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61f333fe5959805fc6bb358842087a64ad1d07617cf06a895dd0d766380b4f6b","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:50:28.931954Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.21000/citation-record","integrity":"/paper/2607.21000/integrity","json":"/paper/2607.21000/citation-record.json","paper":"/paper/2607.21000"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.04927","last_updated":"2023-12-08T09:44:25Z","snapshot_observed_at":"2026-08-13T05:07:21.762970Z","submitted_at":"2023-12-08T09:44:25Z","title":"Zoology: Measuring and Improving Recall in Efficient Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04927","snapshot_observed_at":"2026-08-01T08:50:26.674694Z","title":"Zoology: Measuring and improving recall in efficient language models.arXiv preprint arXiv:2312.04927, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:26.674694Z"},"links":{"cited_paper":"/paper/2312.04927","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:4d42bd24a18fb34d352e2a7ae7ee6d25d96388f8d297a41ab520ddc6bbeae337","observation_id":"aacbfb5d-bb69-45f8-b287-84378d4616d2","resolution":{"observed_at":"2026-08-01T08:50:26.674694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18668","last_updated":"2025-03-07T18:57:52Z","snapshot_observed_at":"2026-08-13T04:07:54.136779Z","submitted_at":"2024-02-28T19:28:27Z","title":"Simple linear attention language models balance the recall-throughput tradeoff","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18668","snapshot_observed_at":"2026-08-01T08:50:26.748421Z","title":"Simple linear attention language models balance the recall- throughput tradeoff","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:26.748421Z"},"links":{"cited_paper":"/paper/2402.18668","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:71f3122882acc0f0998f432f7ef2049e3d16a1009c7fdccd06782bff874a8865","observation_id":"ee54b19b-59c5-4c84-a61d-3551dfa22dcf","resolution":{"observed_at":"2026-08-01T08:50:26.748421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04517","last_updated":"2024-12-06T15:42:07Z","snapshot_observed_at":"2026-08-13T00:12:52.837133Z","submitted_at":"2024-05-07T17:50:21Z","title":"xLSTM: Extended Long Short-Term Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04517","snapshot_observed_at":"2026-08-01T08:50:26.873115Z","title":"xLSTM: Extended long short- term memory.arXiv preprint arXiv:2405.04517, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:26.873115Z"},"links":{"cited_paper":"/paper/2405.04517","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:f52e7203519d3ad661de18cefe8f68ac2bc3482f0667deb398d10de5048cf17b","observation_id":"65140599-78aa-4fa9-8a41-6a79ec100849","resolution":{"observed_at":"2026-08-01T08:50:26.873115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07839","last_updated":"2024-08-28T15:05:42Z","snapshot_observed_at":"2026-08-13T01:17:35.021359Z","submitted_at":"2024-04-11T15:27:22Z","title":"RecurrentGemma: Moving Past Transformers for Efficient Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07839","snapshot_observed_at":"2026-08-01T08:50:27.042281Z","title":"Smith, Anushan Fernando, George-Cristian Muraru, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.042281Z"},"links":{"cited_paper":"/paper/2404.07839","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:e41b2ca931c4464de010c732131311ad69a2e319bdf5c06cf5f9d94b3841d730","observation_id":"17b26bb8-e125-4569-a906-7f8756d4890b","resolution":{"observed_at":"2026-08-01T08:50:27.042281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-01T08:50:27.204477Z","title":"Transformers are SSMs: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.204477Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:82148351671a4a04492d15cf47201ade24ff85b0ddd60c3d6cca2c78887637a4","observation_id":"36f0a150-2563-4d7b-befc-4cfc539083eb","resolution":{"observed_at":"2026-08-01T08:50:27.204477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.08083","last_updated":"2017-09-08T22:26:49Z","snapshot_observed_at":"2026-08-13T02:05:56.906265Z","submitted_at":"2016-12-23T20:32:33Z","title":"Language Modeling with Gated Convolutional Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.08083","snapshot_observed_at":"2026-08-01T08:50:27.302479Z","title":"Language modeling with gated convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.302479Z"},"links":{"cited_paper":"/paper/1612.08083","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:d75cd3e0ea3dbb3b48208b266cdd9075574a0d2cd368d2262e1e3a52c3b36d0f","observation_id":"90c92607-4d00-440b-ac83-01026efb4e16","resolution":{"observed_at":"2026-08-01T08:50:27.302479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19427","last_updated":"2024-02-29T18:24:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T18:24:46Z","title":"Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19427","snapshot_observed_at":"2026-08-01T08:50:27.486817Z","title":"Griffin: Mixing gated linear recurrences with local attention for efficient language models.arXiv preprint arXiv:2402.19427, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.486817Z"},"links":{"cited_paper":"/paper/2402.19427","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:98ae64bb04e3400cc0f4b1ce37e060b8544685f192ce4770ea8ce37330655b74","observation_id":"a0cfcff2-a546-453e-b2f3-78a39821840b","resolution":{"observed_at":"2026-08-01T08:50:27.486817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:50:27.645865Z","title":"Fu, Tri Dao, Khaled K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.645865Z"},"links":{"citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:9bbed0bf94c7b76e3496a704dce17d649be8eff688e7cd432c0faae7a7f5582d","observation_id":"aba9ba16-eb99-4bd7-9ceb-984b9c1613ae","resolution":{"observed_at":"2026-08-01T08:50:27.645865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-01T08:50:27.806978Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.arXiv preprint arXiv:2312.00752, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.806978Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:b273fe43365d347373b60c0f83925d5fa639b9bcbe67b7a84868989b65768318","observation_id":"549e25b3-c02f-4092-a8e7-6d0b30219f8f","resolution":{"observed_at":"2026-08-01T08:50:27.806978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-01T08:50:27.884383Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:27.884383Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:ed80bb0d2f9839a8951c7b08d22eb6be9940258fceb2b3132bfc766da03d2ad3","observation_id":"9c4c1b67-3a27-41a9-a349-950e80e8dfd5","resolution":{"observed_at":"2026-08-01T08:50:27.884383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-01T08:50:28.048203Z","title":"Jamba: A hybrid transformer-mamba language model.arXiv preprint arXiv:2403.19887, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.048203Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:46e41a324f59601d04c98979de30697a91d3d1c86c69cea0177d127326c2b95a","observation_id":"a268a6e7-7e09-4714-9cc9-1e922f607ae5","resolution":{"observed_at":"2026-08-01T08:50:28.048203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10749","last_updated":"2023-05-02T14:16:15Z","snapshot_observed_at":"2026-08-13T14:01:48.705870Z","submitted_at":"2022-10-19T17:45:48Z","title":"Transformers Learn Shortcuts to Automata","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10749","snapshot_observed_at":"2026-08-01T08:50:28.180150Z","title":"Transformers learn shortcuts to automata","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.180150Z"},"links":{"cited_paper":"/paper/2210.10749","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:8106932fc3f98d6788f50423c364d2bbd49602630485c1b584e76b62f7a7dc95","observation_id":"643edcf8-3e44-44a7-946f-a011eac12d90","resolution":{"observed_at":"2026-08-01T08:50:28.180150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:50:28.255172Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.255172Z"},"links":{"citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:ba1698dd8c784768f192ee775b26103b574dd3816f44624b216fd09f4a1e31cd","observation_id":"6927f64e-5c23-4bf6-bd33-efaedb289a3b","resolution":{"observed_at":"2026-08-01T08:50:28.255172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:50:28.292044Z","title":"Smith, Albert Gu, Anushan Fernando, Caglar Gulcehre, Razvan Pascanu, and Soham De","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.292044Z"},"links":{"citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:f6c2182f3fe30168c178f783db5f0aac858562065347bb7eb3efa0cf6bbb11dd","observation_id":"5f3ac7f8-d52f-4a12-b404-3b47bad14d87","resolution":{"observed_at":"2026-08-01T08:50:28.292044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-01T08:50:28.358991Z","title":"Wind, Stanislaw Wozniak, Ruichong Zhang, Zhenyuan Zhang, Qihang Zhao, Peng Zhou, Jian Zhu, and Rui-Jie Zhu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.358991Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:7463be3f07203f10940df391205c47d6b52e188e7c9f71d5c587979a84fdb37d","observation_id":"81cfd8b6-6860-47cf-b7f3-d7674237d49c","resolution":{"observed_at":"2026-08-01T08:50:28.358991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05892","last_updated":"2024-09-26T22:39:08Z","snapshot_observed_at":"2026-08-12T16:03:56.235250Z","submitted_at":"2024-04-08T22:20:59Z","title":"Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05892","snapshot_observed_at":"2026-08-01T08:50:28.406256Z","title":"Eagle and finch: R WKV with matrix-valued states and dynamic recurrence.arXiv preprint arXiv:2404.05892, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.406256Z"},"links":{"cited_paper":"/paper/2404.05892","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:9a066ad2fd210981a6a8131efb6332579d3b4516602089da36f5ae6a71af250b","observation_id":"8213667b-2f39-4066-861d-1a03936681bf","resolution":{"observed_at":"2026-08-01T08:50:28.406256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04823","last_updated":"2023-11-08T16:50:05Z","snapshot_observed_at":"2026-08-13T05:29:43.525806Z","submitted_at":"2023-11-08T16:50:05Z","title":"Hierarchically Gated Recurrent Neural Network for Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04823","snapshot_observed_at":"2026-08-01T08:50:28.468423Z","title":"Hierarchically gated recurrent neural network for sequence modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.468423Z"},"links":{"cited_paper":"/paper/2311.04823","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:adb110358071a9694767bdd700b20975186525490f8fe14a7e19f8e23a40fe73","observation_id":"00f96e30-70fc-4b25-a8eb-df042fe2bb3a","resolution":{"observed_at":"2026-08-01T08:50:28.468423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:50:28.552704Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8), 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.552704Z"},"links":{"citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:51d3fb9340eff89c6b0d2e16359b725b458a2f28b0e2714bc8bffd3be036214e","observation_id":"9a354378-6297-447e-a6e8-99bf9f1706a1","resolution":{"observed_at":"2026-08-01T08:50:28.552704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-01T08:50:28.635822Z","title":"GLU variants improve transformer.arXiv preprint arXiv:2002.05202, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.635822Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:4ebcc47856bb3028268a46222b74b8cd8f53ec348a540dd7216f1156bb844ee1","observation_id":"117b2f98-a715-4479-bb50-17ef6b00f495","resolution":{"observed_at":"2026-08-01T08:50:28.635822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:50:28.726907Z","title":"RoFormer: Enhanced transformer with rotary position embedding.Neurocomputing, 568, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.726907Z"},"links":{"citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:70dad1e540c908faaa6d1597708fa0522b7e772115219ae42a1b99a7d03e71e2","observation_id":"f50134c8-aa43-4da7-939c-b3be454c28c9","resolution":{"observed_at":"2026-08-01T08:50:28.726907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-01T08:50:28.791457Z","title":"Retentive network: A successor to transformer for large language models.arXiv preprint arXiv:2307.08621, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.791457Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:f73debf00b3321511142e811d56a40aa27d7f3b042435c670aa911530784c79b","observation_id":"1d99ec86-47ee-4802-8eb1-c3ed17ae6e89","resolution":{"observed_at":"2026-08-01T08:50:28.791457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04006","last_updated":"2020-11-08T15:53:56Z","snapshot_observed_at":"2026-08-09T15:12:21.086848Z","submitted_at":"2020-11-08T15:53:56Z","title":"Long Range Arena: A Benchmark for Efficient Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.04006","snapshot_observed_at":"2026-08-01T08:50:28.861491Z","title":"Long range arena: A benchmark for efficient transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.861491Z"},"links":{"cited_paper":"/paper/2011.04006","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:574d2f69b64a08453c97f0a697c7b4bfb864d8e685cb3b9c0df163452429b76e","observation_id":"3cc85aaa-56af-4fe0-a587-88bc5020ac01","resolution":{"observed_at":"2026-08-01T08:50:28.861491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06635","last_updated":"2024-08-27T01:27:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-11T18:51:59Z","title":"Gated Linear Attention Transformers with Hardware-Efficient Training","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06635","snapshot_observed_at":"2026-08-01T08:50:28.931954Z","title":"Gated linear atten- tion transformers with hardware-efficient training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T08:50:28.931954Z"},"links":{"cited_paper":"/paper/2312.06635","citing_paper":"/paper/2607.21000"},"observation_digest":"sha256:42ef8522793efbf982518ff8c11103b4663489e9f6ba02641aa33ba3b0af4062","observation_id":"da024c7d-19c5-4621-9fe9-edaeeb674325","resolution":{"observed_at":"2026-08-01T08:50:28.931954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.21000","last_updated":"2026-07-23T07:34:07Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-11T13:49:54.005517Z","submitted_at":"2026-07-23T07:34:07Z","title":"Naju: A Native Discrete State-Space Model with Independent Retention and Writing for Long-Sequence Memory"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.21000."}