{"as_of":"2026-08-10T09:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4354cde1177df0d6c1647484bce854b9f3b11f0837c5848cca7b8d658a9cbd90","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:17:24.839680Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19472/citation-record","integrity":"/paper/2505.19472/integrity","json":"/paper/2505.19472/citation-record.json","paper":"/paper/2505.19472"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T14:17:23.520664Z","title":"Phi-3 technical report: A highly capable language model locally on your phone.arXiv preprint arXiv:2404.14219,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.520664Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:4539e6cbbbf483d94f54b9e88b51dc0b167327d8b94a5d5eec2d3392538d925d","observation_id":"a7279278-0e48-4015-aaed-be29ce74d873","resolution":{"observed_at":"2026-08-07T14:17:23.520664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14052","last_updated":"2023-04-29T03:18:40Z","snapshot_observed_at":"2026-08-06T18:01:24.576458Z","submitted_at":"2022-12-28T17:56:03Z","title":"Hungry Hungry Hippos: Towards Language Modeling with State Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14052","snapshot_observed_at":"2026-08-07T14:17:23.744022Z","title":"Hungry hungry hippos: Towards language modeling with state space models.arXiv preprint arXiv:2212.14052,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.744022Z"},"links":{"cited_paper":"/paper/2212.14052","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:adb71803164ed4df601b3c253e1963f799c09022c78727f85939664fa70de4c3","observation_id":"3df97dfd-3053-4c74-bb2c-37ca105293cb","resolution":{"observed_at":"2026-08-07T14:17:23.744022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-07T14:17:23.971734Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.971734Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:031fa2ab8df58ba85af52f52af3e6d95de3d16d60a526640f4b9f0c2ff3b67a6","observation_id":"2803124a-5e76-452e-b177-255c78c8e63f","resolution":{"observed_at":"2026-08-07T14:17:23.971734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16300","last_updated":"2023-11-20T01:16:17Z","snapshot_observed_at":"2026-08-04T15:01:39.394740Z","submitted_at":"2023-05-25T17:53:42Z","title":"Landmark Attention: Random-Access Infinite Context Length for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16300","snapshot_observed_at":"2026-08-07T14:17:24.269674Z","title":"Landmark attention: Random-access infinite context length for transformers.arXiv preprint arXiv:2305.16300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.269674Z"},"links":{"cited_paper":"/paper/2305.16300","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:97d3b0bae9a9111b1d2b2c1c8bdb256dc781c8bb3af904bfc0e0f6bcae53a720","observation_id":"844da00b-9e6d-42e3-b7b0-16ff33187d6c","resolution":{"observed_at":"2026-08-07T14:17:24.269674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04248","last_updated":"2024-04-25T17:01:52Z","snapshot_observed_at":"2026-08-09T03:26:38.274258Z","submitted_at":"2024-02-06T18:56:35Z","title":"Can Mamba Learn How to Learn? A Comparative Study on In-Context Learning Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04248","snapshot_observed_at":"2026-08-07T14:17:24.359568Z","title":"Can mamba learn how to learn? a comparative study on in-context learning tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.359568Z"},"links":{"cited_paper":"/paper/2402.04248","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:7aef75db949a4453e896a6e44dd75a2f04f48086dbda708de0b0a93c3d2184de","observation_id":"5d8e934f-4a6f-4c4f-ac4a-a310580b8552","resolution":{"observed_at":"2026-08-07T14:17:24.359568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-07T14:17:24.438171Z","title":"Rwkv: Reinventing rnns for the transformer era.arXiv preprint arXiv:2305.13048,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.438171Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:54ad1744c858b02adc3178455b488ad0562d17d3fff63a2c890710bbf1aa74d5","observation_id":"1466c386-e7ad-4c74-87d5-4fe7c6d92ae1","resolution":{"observed_at":"2026-08-07T14:17:24.438171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07522","last_updated":"2025-02-28T02:20:49Z","snapshot_observed_at":"2026-08-06T19:04:16.718797Z","submitted_at":"2024-06-11T17:50:51Z","title":"Samba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07522","snapshot_observed_at":"2026-08-07T14:17:24.526655Z","title":"Samba: Simple hybrid state space models for efficient unlimited context language modeling.arXiv preprint arXiv:2406.07522,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.526655Z"},"links":{"cited_paper":"/paper/2406.07522","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:37a89d340a7d82cf1eaf76f3608dffd3ae4d7c55cda74a9163d08451ed295fd3","observation_id":"4666ba30-0ddc-4635-8118-c16861fce410","resolution":{"observed_at":"2026-08-07T14:17:24.526655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12570","last_updated":"2024-08-22T17:38:59Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:38:59Z","title":"Jamba-1.5: Hybrid Transformer-Mamba Models at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12570","snapshot_observed_at":"2026-08-07T14:17:24.615532Z","title":"Jamba Team, Barak Lenz, Alan Arazi, Amir Bergman, Avshalom Manevich, Barak Peleg, Ben Aviram, Chen Almagor, Clara Fridman, Dan Padnos, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.615532Z"},"links":{"cited_paper":"/paper/2408.12570","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:b52869f41539f184e37fcaf7c380400deba7f09c1031607423ba837576e3f793","observation_id":"5df5c35c-815f-4955-8689-579185a4523d","resolution":{"observed_at":"2026-08-07T14:17:24.615532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06635","last_updated":"2024-08-27T01:27:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-11T18:51:59Z","title":"Gated Linear Attention Transformers with Hardware-Efficient Training","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06635","snapshot_observed_at":"2026-08-07T14:17:24.707153Z","title":"Gated linear attention transformers with hardware-efficient training.arXiv preprint arXiv:2312.06635,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.707153Z"},"links":{"cited_paper":"/paper/2312.06635","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:3a461c3411475f7de35c0375593441ac9a71b0cbd6eef9fe3705800552b85c04","observation_id":"8cad88c7-8ce7-4865-b85a-1e2dd8b1f83c","resolution":{"observed_at":"2026-08-07T14:17:24.707153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14577","last_updated":"2025-04-01T04:41:35Z","snapshot_observed_at":"2026-08-09T16:44:46.990151Z","submitted_at":"2025-01-24T15:33:05Z","title":"ZETA: Leveraging Z-order Curves for Efficient Top-k Attention","version":3},"cited_work":{"arxiv_id":"2501.14577","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.14577","snapshot_observed_at":"2026-08-07T14:17:24.979226Z","title":"ZETA: Leveraging Z-order Curves for Efficient Top-k Attention","venue":"cs.LG","work_id":"da20fce6-42c2-4fc4-bb89-1c0bfd8fa45c","year":2025},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.839680Z"},"links":{"cited_paper":"/paper/2501.14577","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:192215a8990a601fa7dc3b8de2d38e6d276866cfec6330098fd93b40cad17af1","observation_id":"e8f6c4f5-bb6e-4934-8889-7970166d0265","resolution":{"observed_at":"2026-08-07T14:17:25.063174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-07T14:17:24.172253Z","title":"Jamba: A hybrid transformer-mamba language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.172253Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:1cb6b8eb9158264d4269c7b6c121abd47d49e46e1909341ae51c025aaddd17b7","observation_id":"a477360e-5afc-42cf-a9ef-04651aab6cea","resolution":{"observed_at":"2026-08-07T14:17:24.172253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16605","last_updated":"2024-12-02T08:41:46Z","snapshot_observed_at":"2026-07-06T18:20:09.790181Z","submitted_at":"2024-05-26T15:31:09Z","title":"Demystify Mamba in Vision: A Linear Attention Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16605","snapshot_observed_at":"2026-08-07T14:17:24.067573Z","title":"Bridging the divide: Reconsidering softmax and linear attention.Advances in Neural Information Processing Systems, 37:79221–79245, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:24.067573Z"},"links":{"cited_paper":"/paper/2405.16605","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:8640976baf0d64ad4a22519a795d101b8bccbc35cd7bbff9533d29979b08d261","observation_id":"da5afdcc-5471-4a1f-940f-938756a61054","resolution":{"observed_at":"2026-08-07T14:17:24.067573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T14:17:23.879566Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.arXiv preprint arXiv:2312.00752,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.879566Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:efd4e3d9b2c9bddf6289fe13565f370f05a41722b7210a9a50f674ac4cfe88c0","observation_id":"e7cd4254-4cc9-4513-9d29-306d0bffa5ef","resolution":{"observed_at":"2026-08-07T14:17:23.879566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-07T14:17:23.586770Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality.arXiv preprint arXiv:2405.21060,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.586770Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:4b65a14588bf587713572bf6c372ab7732ce29f61770e606313bb69b17e1f56b","observation_id":"811a9032-c5e1-4f61-939f-8e558e124d0e","resolution":{"observed_at":"2026-08-07T14:17:23.586770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13676","last_updated":"2024-11-20T19:51:25Z","snapshot_observed_at":"2026-08-02T12:55:25.835610Z","submitted_at":"2024-11-20T19:51:25Z","title":"Hymba: A Hybrid-head Architecture for Small Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13676","snapshot_observed_at":"2026-08-07T14:17:23.650165Z","title":"Hymba: A hybrid-head architecture for small language models.arXiv preprint arXiv:2411.13676,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:23.650165Z"},"links":{"cited_paper":"/paper/2411.13676","citing_paper":"/paper/2505.19472"},"observation_digest":"sha256:2487ad0869ccfa7dcc0de419cb81dfa0ed2417ba68bd46ccade0a8f8be355bf2","observation_id":"82ae23a5-1ebd-4d31-bb29-1c836f3c8e44","resolution":{"observed_at":"2026-08-07T14:17:23.650165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19472","last_updated":"2025-05-28T11:06:17Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T04:48:13.530730Z","submitted_at":"2025-05-26T03:52:22Z","title":"Balancing Computation Load and Representation Expressivity in Parallel Hybrid Neural Networks"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2505.19472."}