{"as_of":"2026-08-17T12:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a45434ae871363a0198ca453697b7e28ed4ac85b8576a4eb8857bf8c3da3afd","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T06:04:17.621560Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T10:18:04.431436Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T10:21:15.029902Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"cited_work":{"arxiv_id":"2504.19191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19191","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wuneng: Hybrid state with attention.arXiv preprint arXiv:2504.19191","venue":null,"work_id":"1c7c5d8e-6fb6-44d7-a8f0-eb946be5cf35","year":null},"citing_paper":{"arxiv_id":"2510.04800","last_updated":"2026-04-21T13:16:20Z","snapshot_observed_at":"2026-08-12T17:48:16.385812Z","submitted_at":"2025-10-06T13:30:07Z","title":"Hybrid Architectures for Language Models: Systematic Analysis and Design Insights","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T10:18:04.431436Z"},"links":{"cited_paper":"/paper/2504.19191","citing_paper":"/paper/2510.04800"},"observation_digest":"sha256:7156b8187f1c55b3f72ae10502a0619f79af7363059692eb3422023b1dec7065","observation_id":"f557a6ed-7f2f-4706-a9a1-a9d60fe27f5c","resolution":{"observed_at":"2026-05-18T10:21:15.034776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.19191/citation-record","integrity":"/paper/2504.19191/integrity","json":"/paper/2504.19191/citation-record.json","paper":"/paper/2504.19191"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.04517","last_updated":"2024-12-06T15:42:07Z","snapshot_observed_at":"2026-08-16T13:54:34.627474Z","submitted_at":"2024-05-07T17:50:21Z","title":"xLSTM: Extended Long Short-Term Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04517","snapshot_observed_at":"2026-08-16T06:04:17.549359Z","title":"xlstm: Ex- tended long short-term memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.549359Z"},"links":{"cited_paper":"/paper/2405.04517","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:90ecd51bce10653dff1885061383ee0a13a16686bd564ef38ba0c28d59646558","observation_id":"315d81be-b6b8-4042-9a99-fa7f1bc8cd5d","resolution":{"observed_at":"2026-08-16T06:04:17.549359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02355","last_updated":"2025-04-22T16:15:47Z","snapshot_observed_at":"2026-08-16T13:13:01.876137Z","submitted_at":"2024-10-03T10:06:27Z","title":"AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02355","snapshot_observed_at":"2026-08-16T06:04:17.558885Z","title":"Alphaedit: Null-space constrained knowledge editing for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.558885Z"},"links":{"cited_paper":"/paper/2410.02355","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:4f9dbf9b696128901f9d1ed87fcf1f3f2d65d4d19817b1bb40263a6edd032aff","observation_id":"0acc6595-161f-40ec-a9b8-7a17b1038006","resolution":{"observed_at":"2026-08-16T06:04:17.558885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-16T23:36:44.216328Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-16T06:04:17.563505Z","title":"Better & faster large language models via multi-token prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.563505Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:301d8b9da90ba60f70f5e315190df2ad93722cdda2ffedce785fba015f985f81","observation_id":"4e1a7e85-52a0-488c-a1a7-f65bf68e9c49","resolution":{"observed_at":"2026-08-16T06:04:17.563505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00927","last_updated":"2025-07-11T15:49:30Z","snapshot_observed_at":"2026-08-16T12:44:53.955592Z","submitted_at":"2025-04-01T15:59:32Z","title":"Multi-Token Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00927","snapshot_observed_at":"2026-08-16T06:04:17.567996Z","title":"Multi- token attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.567996Z"},"links":{"cited_paper":"/paper/2504.00927","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:3b85ec06ab46d107175e7cdcd47239fc523bf973875882817db0b0f0725e114d","observation_id":"15d5e481-f2f0-4e89-a9c6-44098b5f37ec","resolution":{"observed_at":"2026-08-16T06:04:17.567996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-16T06:04:17.576870Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.576870Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:98a6d84a360fb1c9805ec4c943e6d9d64e49bd18caa2284842e92305a753aa55","observation_id":"aa0c822a-3c81-4523-99b6-ef0f97b7dea6","resolution":{"observed_at":"2026-08-16T06:04:17.576870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13189","last_updated":"2025-02-18T14:06:05Z","snapshot_observed_at":"2026-08-12T19:30:23.025771Z","submitted_at":"2025-02-18T14:06:05Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13189","snapshot_observed_at":"2026-08-16T06:04:17.586116Z","title":"Moba: Mixture of block attention for long-context llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.586116Z"},"links":{"cited_paper":"/paper/2502.13189","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:68a854916f69dd99c00aea82f44773d722a387735f5b1b9b931594791b8fb893","observation_id":"4728e636-197a-4d25-be7b-832345012642","resolution":{"observed_at":"2026-08-16T06:04:17.586116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:04:17.873136Z","title":"Rwkv: Reinventing rnns for the transformer era,","venue":null,"work_id":"9fdb6df6-d415-46b3-9674-341f67833106","year":2023},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.590708Z"},"links":{"citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:b67355603b6effb74ceebd75fdcae0fe375d92e175d8577ec3c39f59e711f67b","observation_id":"5a599f03-cd17-4baa-a2ea-5ebeebfd821a","resolution":{"observed_at":"2026-08-16T06:04:17.877439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14456","last_updated":"2025-03-30T13:46:44Z","snapshot_observed_at":"2026-08-16T12:48:54.019542Z","submitted_at":"2025-03-18T17:31:05Z","title":"RWKV-7 \"Goose\" with Expressive Dynamic State Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14456","snapshot_observed_at":"2026-08-16T06:04:17.594872Z","title":"Rwkv-7” goose” with ex- pressive dynamic state evolution","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.594872Z"},"links":{"cited_paper":"/paper/2503.14456","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:77ec168db9c729d992a292b93c872858f16f95ea0fca0aeb60c8291a4f2ee4e6","observation_id":"aa4e2954-1222-4fb6-a6fb-1695c7790b4b","resolution":{"observed_at":"2026-08-16T06:04:17.594872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-16T06:04:17.599270Z","title":"Retentive network: A successor to transformer for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.599270Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:2cfe54be7f77c48564e6ae5350f3b57b615c7e2139b87c5cb387e6f13bf67db9","observation_id":"138e305f-603e-49e5-84af-e94565519f82","resolution":{"observed_at":"2026-08-16T06:04:17.599270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:04:17.859809Z","title":"Atten- tion is all you need","venue":null,"work_id":"1ba94df7-445d-48b3-8710-387543a39991","year":2017},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.603764Z"},"links":{"citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:e1cbbbeab128e53ae7b188a6e11631364035d32c17db894bc2179d6571db991b","observation_id":"08fabaa2-6523-4a65-b87a-07d95f75d112","resolution":{"observed_at":"2026-08-16T06:04:17.864228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06464","last_updated":"2025-03-06T06:57:34Z","snapshot_observed_at":"2026-08-14T21:08:22.323819Z","submitted_at":"2024-12-09T13:09:04Z","title":"Gated Delta Networks: Improving Mamba2 with Delta Rule","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06464","snapshot_observed_at":"2026-08-16T06:04:17.612526Z","title":"Gated delta networks: Improv- ing mamba2 with delta rule","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.612526Z"},"links":{"cited_paper":"/paper/2412.06464","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:30b3471abde34bc585bdeb49dc5f7f115b486d6defd1e3ae0771eb60372d18d5","observation_id":"7a34c9c6-9e6c-4022-b191-a6c55cabffcd","resolution":{"observed_at":"2026-08-16T06:04:17.612526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-16T16:29:35.500686Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-16T06:04:17.617254Z","title":"Native sparse attention: Hardware-aligned and natively trainable sparse attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.617254Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:d60970838b5a7878958759b0a605a51f054af6b17e5ec97a119ab5743b30002f","observation_id":"8d424d51-8863-4ad7-8f55-dca22e4080e1","resolution":{"observed_at":"2026-08-16T06:04:17.617254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15570","last_updated":"2025-01-26T15:56:56Z","snapshot_observed_at":"2026-08-12T17:42:30.931117Z","submitted_at":"2025-01-26T15:56:56Z","title":"ARWKV: Pretrain is not what we need, an RNN-Attention-Based Language Model Born from Transformer","version":1},"cited_work":{"arxiv_id":"2501.15570","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15570","snapshot_observed_at":"2026-08-16T06:04:17.655039Z","title":"ARWKV: Pretrain is not what we need, an RNN-Attention-Based Language Model Born from Transformer","venue":"cs.CL","work_id":"992fadc3-4e0f-4e87-8eab-a0f0b00039ea","year":2025},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.621560Z"},"links":{"cited_paper":"/paper/2501.15570","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:f2118c53934059c52029f6f4404222df9d0a8322b005411440bb67ddfc9907e5","observation_id":"01396e12-3e86-4391-8b37-619868fd0920","resolution":{"observed_at":"2026-08-16T06:04:17.663113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T06:04:17.607788Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.607788Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:0fe49455b8de837a98fcb15d1d19c924c02620ca7c493c6a3f9991cbbe4650c6","observation_id":"6b2258ad-e7ef-4c24-8a6d-78f87d5299cd","resolution":{"observed_at":"2026-08-16T06:04:17.607788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08313","last_updated":"2025-01-14T18:50:05Z","snapshot_observed_at":"2026-08-13T08:34:05.764059Z","submitted_at":"2025-01-14T18:50:05Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08313","snapshot_observed_at":"2026-08-16T06:04:17.581270Z","title":"Minimax-01: Scaling foundation models with lightning attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.581270Z"},"links":{"cited_paper":"/paper/2501.08313","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:539217922d4f0650accf22e37ac9aa30823323496d0d6f0738e9daf0e92d8f78","observation_id":"b9025d1c-fbfd-4fe7-adff-ff535499951c","resolution":{"observed_at":"2026-08-16T06:04:17.581270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13676","last_updated":"2024-11-20T19:51:25Z","snapshot_observed_at":"2026-08-14T20:26:44.533985Z","submitted_at":"2024-11-20T19:51:25Z","title":"Hymba: A Hybrid-head Architecture for Small Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13676","snapshot_observed_at":"2026-08-16T06:04:17.554378Z","title":"Hymba: A hybrid-head architecture for small language mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.554378Z"},"links":{"cited_paper":"/paper/2411.13676","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:d0387fb8874e17f09245bbf2e5102070d768d8b049a4049c171236b068240ba9","observation_id":"fe8bfa86-92cd-4487-8296-e4d8b474fb52","resolution":{"observed_at":"2026-08-16T06:04:17.554378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T06:04:17.572425Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:17.572425Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.19191"},"observation_digest":"sha256:228e207d685b5bd336bcb11465b275f945279bdb824d1a5d6b29b3646a866ff4","observation_id":"0426a6c7-7434-4272-81ec-259fb8967b2b","resolution":{"observed_at":"2026-08-16T06:04:17.572425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19191","last_updated":"2025-04-27T10:48:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T05:57:01.806757Z","submitted_at":"2025-04-27T10:48:56Z","title":"WuNeng: Hybrid State with Attention"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2504.19191."}