{"as_of":"2026-08-09T18:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fb5cad33c9cab298c343aadd8c603e074d8b5ef177036c2dd9098d5eac2f4b9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:13:38.365883Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":"2408.15237","doi":"10.48550/arxiv.2408.15237","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., and Dao, T","venue":"arXiv (Cornell University)","work_id":"f3d96c6b-3711-4ecc-a229-a36268dcde4a","year":2025},"citing_paper":{"arxiv_id":"2410.13846","last_updated":"2026-05-18T05:12:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T17:58:14Z","title":"LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T18:31:35.391674Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2410.13846"},"observation_digest":"sha256:4ad5608e4482f0caf18318cc48e48f2f4e22049f535f94b8e34611ea2eab3e11","observation_id":"629d0469-8138-4523-90c8-69168619152b","resolution":{"observed_at":"2026-05-23T18:33:19.586630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":"2408.15237","doi":"10.48550/arxiv.2408.15237","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., and Dao, T","venue":"arXiv (Cornell University)","work_id":"f3d96c6b-3711-4ecc-a229-a36268dcde4a","year":2025},"citing_paper":{"arxiv_id":"2410.17891","last_updated":"2025-05-31T07:01:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-23T14:04:22Z","title":"Scaling Diffusion Language Models via Adaptation from Autoregressive Models","version":3},"reference_index":188,"source":"arxiv_source","source_observed_at":"2026-05-20T19:59:36.461146Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2410.17891"},"observation_digest":"sha256:fe9b4407417ae612f35ddf4effb8c8b5de53a1bdb88892f913b42a6c877f0f24","observation_id":"ef917ae9-6c86-448b-a5b7-07478aca5ddb","resolution":{"observed_at":"2026-05-20T19:59:36.652779Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-08T14:13:38.365883Z","title":"M., and Dao, T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.06975","last_updated":"2025-02-10T19:14:51Z","snapshot_observed_at":"2026-08-08T23:51:33.892065Z","submitted_at":"2025-02-10T19:14:51Z","title":"Position: Episodic Memory is the Missing Piece for Long-Term LLM Agents","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-08T14:13:38.365883Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2502.06975"},"observation_digest":"sha256:dbda87e86ec945cb5cd90ab26387b501f7fdd48ff97edcb2c9674589ef28f033","observation_id":"834622e6-ba61-410a-91a0-4c5cc71b42c5","resolution":{"observed_at":"2026-08-08T14:13:38.365883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":"2408.15237","doi":"10.48550/arxiv.2408.15237","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., and Dao, T","venue":"arXiv (Cornell University)","work_id":"f3d96c6b-3711-4ecc-a229-a36268dcde4a","year":2025},"citing_paper":{"arxiv_id":"2502.13189","last_updated":"2025-02-18T14:06:05Z","snapshot_observed_at":"2026-07-06T20:38:48.725605Z","submitted_at":"2025-02-18T14:06:05Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-16T06:15:46.085555Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2502.13189"},"observation_digest":"sha256:60f7a45e488273ec9689c3db52acfcfe5bb717c1b54c964734ada2951b115af8","observation_id":"89a7a419-4dd7-40de-9e05-ed267e17c94f","resolution":{"observed_at":"2026-05-16T06:15:46.173069Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-07T11:55:13.601300Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01206","last_updated":"2025-06-01T22:52:47Z","snapshot_observed_at":"2026-08-08T21:58:33.445175Z","submitted_at":"2025-06-01T22:52:47Z","title":"Mamba Drafters for Speculative Decoding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:13.601300Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2506.01206"},"observation_digest":"sha256:5867f7a3b60876256d457157eb2cb6dc6115d6142e2132663588403387c68af6","observation_id":"a325eb72-6e96-4927-9d64-b2471d5545b9","resolution":{"observed_at":"2026-08-07T11:55:13.601300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-07T04:58:54.509957Z","title":"M., and Dao, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09316","last_updated":"2025-06-17T04:56:46Z","snapshot_observed_at":"2026-08-07T11:02:36.129585Z","submitted_at":"2025-06-11T01:25:06Z","title":"On-the-Fly Adaptive Distillation of Transformer to Dual-State Linear Attention","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T04:58:54.509957Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2506.09316"},"observation_digest":"sha256:f439b7e5ae2d992818ce9291b69f418abd6c25ab5d4dd79a9e4db084f1b0d8de","observation_id":"c37d3d81-be26-491d-8cf4-c007a1195ab3","resolution":{"observed_at":"2026-08-07T04:58:54.509957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-07T04:21:19.047077Z","title":"The mamba in the llama: Distilling and accelerating hybrid models.arXiv preprint arXiv:2408.15237, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10915","last_updated":"2026-07-10T04:56:00Z","snapshot_observed_at":"2026-08-09T05:08:57.326158Z","submitted_at":"2025-06-12T17:29:40Z","title":"M4V: Multimodal Mamba for Efficient Text-to-Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:21:19.047077Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2506.10915"},"observation_digest":"sha256:edddf03464723a4220cc814192565265ae9f11c774a9c2d2f501650522ea4deb","observation_id":"3f89ebbd-a47e-45c7-bfcc-a5ded8772ed8","resolution":{"observed_at":"2026-08-07T04:21:19.047077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-06T20:20:45.689403Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03340","last_updated":"2025-07-04T06:59:17Z","snapshot_observed_at":"2026-08-09T06:26:05.307563Z","submitted_at":"2025-07-04T06:59:17Z","title":"Degrees of Freedom for Linear Attention: Distilling Softmax Attention with Optimal Feature Efficiency","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T20:20:45.689403Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2507.03340"},"observation_digest":"sha256:9c801976fcd0badcef385352707d1aae43a7b1551dee5ebb13e8ed4967143206","observation_id":"e9165664-45c3-4da1-9cbd-34d955ad0e27","resolution":{"observed_at":"2026-08-06T20:20:45.689403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":"2408.15237","doi":"10.48550/arxiv.2408.15237","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., and Dao, T","venue":"arXiv (Cornell University)","work_id":"f3d96c6b-3711-4ecc-a229-a36268dcde4a","year":2025},"citing_paper":{"arxiv_id":"2604.14191","last_updated":"2026-04-01T09:23:08Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-01T09:23:08Z","title":"Attention to Mamba: A Recipe for Cross-Architecture Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T23:07:41.022051Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2604.14191"},"observation_digest":"sha256:229cc7d649e8daa4c275d49368bf9dab9c6ab742baf695ed16099547fc0a90f2","observation_id":"ce0030e6-0d75-4819-a546-b8729d8986aa","resolution":{"observed_at":"2026-05-13T23:08:25.062291Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":"2408.15237","doi":"10.48550/arxiv.2408.15237","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., and Dao, T","venue":"arXiv (Cornell University)","work_id":"f3d96c6b-3711-4ecc-a229-a36268dcde4a","year":2025},"citing_paper":{"arxiv_id":"2605.01048","last_updated":"2026-05-01T19:23:33Z","snapshot_observed_at":"2026-07-06T23:14:20.123289Z","submitted_at":"2026-05-01T19:23:33Z","title":"Compared to What? Baselines and Metrics for Counterfactual Prompting","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-09T19:02:46.991897Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2605.01048"},"observation_digest":"sha256:3a1f1b13a0883ff6be526017924dda7494e4bebbec99a506419a662fe6b35fc2","observation_id":"47f8e4c7-f8c6-473e-8393-463ab6fe6d20","resolution":{"observed_at":"2026-05-09T19:05:10.516088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":"2408.15237","doi":"10.48550/arxiv.2408.15237","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M., and Dao, T","venue":"arXiv (Cornell University)","work_id":"f3d96c6b-3711-4ecc-a229-a36268dcde4a","year":2025},"citing_paper":{"arxiv_id":"2606.06479","last_updated":"2026-07-24T17:49:34Z","snapshot_observed_at":"2026-08-02T12:20:41.406405Z","submitted_at":"2026-06-04T17:57:33Z","title":"Pretraining Recurrent Networks without Recurrence","version":1},"reference_index":131,"source":"pdf_text","source_observed_at":"2026-06-28T02:09:01.018909Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2606.06479"},"observation_digest":"sha256:99915e18e5de1249cd9e8c97f0f9cfb86d565d88cbb4642914a92de6df8384c2","observation_id":"eca2c765-30f8-4d72-a5ee-e0aa3bb22cf1","resolution":{"observed_at":"2026-07-02T12:26:56.606074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-02T12:20:56.038155Z","title":"Rush, and Tri Dao","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06479","last_updated":"2026-07-24T17:49:34Z","snapshot_observed_at":"2026-08-02T12:20:41.406405Z","submitted_at":"2026-06-04T17:57:33Z","title":"Pretraining Recurrent Networks without Recurrence","version":2},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-02T12:20:56.038155Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2606.06479"},"observation_digest":"sha256:3cd40c83c5e86e83a7984cb30ea9b960767d585f4c94d5276a0d7d1fa157ac68","observation_id":"2136ee1a-24d7-455e-afa1-8b89343b0f7f","resolution":{"observed_at":"2026-08-02T12:20:56.038155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-02T06:39:24.912145Z","title":"Rush, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14144","last_updated":"2026-07-31T05:37:48Z","snapshot_observed_at":"2026-08-06T19:33:05.649205Z","submitted_at":"2026-07-14T05:52:12Z","title":"The Capability Convergence Hypothesis: Capability from Access Structure, Not Scale","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T06:39:24.912145Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2607.14144"},"observation_digest":"sha256:6b1eee6202b39436778fe4532b930816228c90ea996001ef171539411c183943","observation_id":"aa204eff-a934-4e20-a399-c3493dd285e9","resolution":{"observed_at":"2026-08-02T06:39:24.912145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-03T02:03:25.437554Z","title":"Rush, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14144","last_updated":"2026-07-31T05:37:48Z","snapshot_observed_at":"2026-08-06T19:33:05.649205Z","submitted_at":"2026-07-14T05:52:12Z","title":"The Capability Convergence Hypothesis: Capability from Access Structure, Not Scale","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T02:03:25.437554Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2607.14144"},"observation_digest":"sha256:7080333a5ce8fdc9688d8c879228d78525f767b726b6ebb3e227cb6d4f8fe72d","observation_id":"ab9985f5-551e-4400-ad27-28d9255d6877","resolution":{"observed_at":"2026-08-03T02:03:25.437554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-01T02:44:01.790175Z","title":"Kaiyue Wen, Xingyu Dang, and Kaifeng Lyu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25357","last_updated":"2026-07-28T07:04:32Z","snapshot_observed_at":"2026-08-08T15:38:21.711545Z","submitted_at":"2026-07-28T07:04:32Z","title":"Raven: High-Recall Sequence Modeling with Sparse Memory Routing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T02:44:01.790175Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2607.25357"},"observation_digest":"sha256:187fa9e8144f040bf300c20762b42cc20f5d78a3dd35e8509f6a0b633e719cf0","observation_id":"039a1726-6e56-4852-8712-b95cf0acf84a","resolution":{"observed_at":"2026-08-01T02:44:01.790175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.15237/citation-record","integrity":"/paper/2408.15237/integrity","json":"/paper/2408.15237/citation-record.json","paper":"/paper/2408.15237"},"outbound":[],"paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T20:29:20.982892Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2408.15237."}