{"as_of":"2026-08-09T15:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3101bf98919f4e1265aef829be9df3ae0e58cd3c12cffa245289a5ba6f73383","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:02:23.655720Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T18:36:57.326532Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T04:26:37.959160Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"cited_work":{"arxiv_id":"2502.07365","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07365","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.07365 , year=","venue":null,"work_id":"9c0db21b-dfc3-491c-9528-9331057c6651","year":null},"citing_paper":{"arxiv_id":"2505.06708","last_updated":"2025-05-10T17:15:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-10T17:15:49Z","title":"Gated Attention for Large Language Models: Non-linearity, Sparsity, and Attention-Sink-Free","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T09:04:34.807225Z"},"links":{"cited_paper":"/paper/2502.07365","citing_paper":"/paper/2505.06708"},"observation_digest":"sha256:b81ab5bb513beeae5a42241ecd985ff82dad0e4e36889557396d0d13d9717b63","observation_id":"617e6ebe-0213-471a-8ec9-013f266d4bf0","resolution":{"observed_at":"2026-05-12T09:04:34.866219Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07365","snapshot_observed_at":"2026-08-02T18:36:57.326532Z","title":"X., Wang, B., and Chen, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.00004","last_updated":"2026-07-23T07:35:13Z","snapshot_observed_at":"2026-08-03T08:52:32.473253Z","submitted_at":"2026-03-09T10:51:01Z","title":"LinearARD: Linear-Memory Attention Distillation for RoPE Restoration","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T18:36:57.326532Z"},"links":{"cited_paper":"/paper/2502.07365","citing_paper":"/paper/2604.00004"},"observation_digest":"sha256:e8b55538599cd7c115287282e10c135e266c64ec795695d165714bf961e72906","observation_id":"29e05937-0a56-4a95-a2ec-8d0fcde0e92b","resolution":{"observed_at":"2026-08-02T18:36:57.326532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"cited_work":{"arxiv_id":"2502.07365","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07365","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.07365 , year=","venue":null,"work_id":"9c0db21b-dfc3-491c-9528-9331057c6651","year":null},"citing_paper":{"arxiv_id":"2605.23414","last_updated":"2026-05-22T09:24:12Z","snapshot_observed_at":"2026-07-06T23:33:39.204744Z","submitted_at":"2026-05-22T09:24:12Z","title":"When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Multi-Agent Systems","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-25T04:25:26.710488Z"},"links":{"cited_paper":"/paper/2502.07365","citing_paper":"/paper/2605.23414"},"observation_digest":"sha256:a64abc48d7dc7cbd8c452e8bea76ee17086abd34258b5705896c6bb76f996a9a","observation_id":"6833c9ec-fbf9-4042-a665-b3d60341940a","resolution":{"observed_at":"2026-05-25T04:26:37.962236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07365/citation-record","integrity":"/paper/2502.07365/integrity","json":"/paper/2502.07365/citation-record.json","paper":"/paper/2502.07365"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.360505Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.360505Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:022132210b8bb8d5e1ea56536c293e4bb25d53203c5a6c11674ebd8156bcb7a0","observation_id":"56b6c24c-f595-457e-84fa-f415cfb9af25","resolution":{"observed_at":"2026-08-08T13:02:23.360505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-08T13:02:23.365078Z","title":"Nye, Maarten Bosma, Henryk Michalewski, David Dohan, Ellen Jiang, Carrie J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.365078Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:ea337db768ebff7e4457c22dc6f139baa9b01adbee284355124f9045080d80f3","observation_id":"2b95d774-fe6e-4ba8-9f93-61e0419da470","resolution":{"observed_at":"2026-08-08T13:02:23.365078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.539722Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":"d78a3a07-8642-4024-831e-75f29d86f3eb","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.369471Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:51b404e65cc3958d7b07d858b8393d60ea591e2e930ff5de2e2f950fd3922257","observation_id":"28ad1b59-5cc6-459f-af0e-1223b3cff38b","resolution":{"observed_at":"2026-08-08T13:02:24.543721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.528984Z","title":null,"venue":null,"work_id":"b80c0524-6ed0-4bb4-9a6f-dee5691a9197","year":2020},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.373701Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:36c1ac16b454d114523119a197c7fbbc1d2efa35d7edd242508078942caf5ff7","observation_id":"3a3c2109-3bce-43c0-80b2-1ec9d4eba098","resolution":{"observed_at":"2026-08-08T13:02:24.532687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.517030Z","title":null,"venue":null,"work_id":"a13dd23b-ccdc-4830-b6eb-4e098bab045c","year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.377192Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:ec41e9582771f907db1799310adc77e4f645e6563d0a6581630f73447529b9fb","observation_id":"aef02e3f-58ca-4827-97cb-528f64ffe928","resolution":{"observed_at":"2026-08-08T13:02:24.521061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.381190Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.381190Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:ff745fe6da57ec6beaa37d4cada8ece575eeeced70dbd44ef76a88fc4ec66112","observation_id":"5b836ad8-1323-4b45-8395-7c36c49286e8","resolution":{"observed_at":"2026-08-08T13:02:23.381190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T13:02:23.385804Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.385804Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:e38d94d5c99ac1bc9200cb1e00048a3199c2bdbdd778b64f2e8f1714c2ac5dee","observation_id":"197500cc-e01d-4e97-a56b-888ac3c22b60","resolution":{"observed_at":"2026-08-08T13:02:23.385804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-08T13:02:23.389865Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.389865Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:57723fa2ca7fd8cf71d2a8a076449e53d148aa529d7a7d59cdb98354473e6ef2","observation_id":"1542440e-ac50-47e8-a02c-c6ed59d6aac1","resolution":{"observed_at":"2026-08-08T13:02:23.389865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.499812Z","title":null,"venue":null,"work_id":"c82984df-ae47-4f7b-820b-dad678267c82","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.394288Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:bf72c5645250c7aac70c8999787928f121cbb483499a52c430320c04186d0b36","observation_id":"0d07e6d3-bc2f-4c7e-933f-dbf62dfd9963","resolution":{"observed_at":"2026-08-08T13:02:24.503196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04548","last_updated":"2025-03-06T15:34:27Z","snapshot_observed_at":"2026-08-07T17:24:22.925386Z","submitted_at":"2025-03-06T15:34:27Z","title":"An Empirical Study on Eliciting and Improving R1-like Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04548","snapshot_observed_at":"2026-08-08T13:02:23.397708Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.397708Z"},"links":{"cited_paper":"/paper/2503.04548","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:a9c81eaeb4149689f01649bdda96db6631871c1978ec246d36728373759cfa69","observation_id":"58656352-dd46-4280-83b0-75243c5d2710","resolution":{"observed_at":"2026-08-08T13:02:23.397708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07825","last_updated":"2025-09-06T13:29:17Z","snapshot_observed_at":"2026-08-04T08:22:01.632124Z","submitted_at":"2024-10-10T11:23:18Z","title":"Extracting and Combining Abilities For Building Multi-lingual Ability-enhanced Large Language Models","version":3},"cited_work":{"arxiv_id":"2410.07825","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07825","snapshot_observed_at":"2026-08-08T13:02:24.112788Z","title":"Extracting and Combining Abilities For Building Multi-lingual Ability-enhanced Large Language Models","venue":"cs.CL","work_id":"2b609471-fa1b-4032-bae8-7f546dd214c4","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.401667Z"},"links":{"cited_paper":"/paper/2410.07825","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:b02e40d38a6180cc3a9874820cc351458f2e9db3d9b95ee6d743f2615602fd90","observation_id":"d9b3a9bc-d3d3-4dfa-b0d3-b98718ec741a","resolution":{"observed_at":"2026-08-08T13:02:24.116534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.405037Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.405037Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:bdb82015c61668b7276e0981e23b2eae57c4e913a191cfd34fd348fa7091f368","observation_id":"bc4fc532-8cd0-4bab-bb8f-14bc18e70400","resolution":{"observed_at":"2026-08-08T13:02:23.405037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.482090Z","title":null,"venue":null,"work_id":"184f3257-b08a-41af-a36c-4f5f3c8fa3e5","year":2018},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.408133Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:a36d8d8231157056849a519b5877fa9e228d30a322f6d236b62d306967f61236","observation_id":"5cfc586c-77e0-4035-a1d3-15f9d1b55dc1","resolution":{"observed_at":"2026-08-08T13:02:24.485847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.470818Z","title":null,"venue":null,"work_id":"a1d0b792-3b82-4e34-be70-275dcc7abb4a","year":2019},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.412060Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:97efe2ac2ffc5859a7510a7c47b286ca3ebe57af3b290498a04c33186212f2cb","observation_id":"e0c6efbf-02ae-409a-bb4b-ca1e5a7f6b8c","resolution":{"observed_at":"2026-08-08T13:02:24.474579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-08T13:02:23.415540Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.415540Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:4518488c6972e979659aa6a8f711f4a7923ffb4c834125efdd5f8fc3d8920c25","observation_id":"150cb29a-d3c1-495e-9d36-8ae0b4f16f21","resolution":{"observed_at":"2026-08-08T13:02:23.415540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T13:02:23.419590Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.419590Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:bbebacda9500b6539d89fe275a2f363baa875a2b67defcb16a5094d3e6661e4d","observation_id":"3ad32f89-ac86-4f3a-b638-04d15be6a4ee","resolution":{"observed_at":"2026-08-08T13:02:23.419590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.423985Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.423985Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:0f92c4349602cd5ba3cffe1750bff11d48f3e891a0accd9781671fd6ab8536e5","observation_id":"d3875485-ab05-4dcd-8dd5-344a9f555086","resolution":{"observed_at":"2026-08-08T13:02:23.423985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.454573Z","title":null,"venue":null,"work_id":"7550f58c-be60-4fe7-a43a-f87fa77facc9","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.427217Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:fef592c43e951661dcdcc233fa1b528156cf77ae3331935c6596d0325ade79a2","observation_id":"afdea3f2-78f4-434c-8520-0159e72e45c7","resolution":{"observed_at":"2026-08-08T13:02:24.457854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18009","last_updated":"2024-11-18T11:15:56Z","snapshot_observed_at":"2026-08-09T05:47:22.861028Z","submitted_at":"2024-05-28T09:50:46Z","title":"Exploring Context Window of Large Language Models via Decomposed Positional Vectors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18009","snapshot_observed_at":"2026-08-08T13:02:23.430948Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.430948Z"},"links":{"cited_paper":"/paper/2405.18009","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:961dd53626f54fa2da592b7ad3c878d65f549856d3ffcb0c3fda87b0c83c4ac3","observation_id":"bda83ab4-589d-497e-ac29-62899cb48527","resolution":{"observed_at":"2026-08-08T13:02:23.430948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06792","last_updated":"2025-05-28T08:08:05Z","snapshot_observed_at":"2026-08-07T21:30:03.529509Z","submitted_at":"2025-04-09T11:34:06Z","title":"Domain-Specific Pruning of Large Mixture-of-Experts Models with Few-shot Demonstrations","version":2},"cited_work":{"arxiv_id":"2504.06792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.06792","snapshot_observed_at":"2026-08-08T13:02:24.070430Z","title":"Domain-Specific Pruning of Large Mixture-of-Experts Models with Few-shot Demonstrations","venue":"cs.CL","work_id":"59e17873-06b0-49cf-b654-f445fda9113c","year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.435083Z"},"links":{"cited_paper":"/paper/2504.06792","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:8fd11b58aa28f5bb99938b3ce62ed805c7e916850cb06647fcfa0685d18b39dc","observation_id":"b4c667c8-0397-4f3f-bb6a-3929a9772ca5","resolution":{"observed_at":"2026-08-08T13:02:24.074610Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14502","last_updated":"2025-06-10T07:17:21Z","snapshot_observed_at":"2026-07-06T14:56:47.509018Z","submitted_at":"2023-02-28T11:34:30Z","title":"A Survey on Long Text Modeling with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14502","snapshot_observed_at":"2026-08-08T13:02:23.438663Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.438663Z"},"links":{"cited_paper":"/paper/2302.14502","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:07bf09b73fd08b5bafa07f1becb922d432ae41a0608c3f697d0b8c411f89e3b4","observation_id":"bc95f4ef-eb88-4cfa-9466-24685a992cf8","resolution":{"observed_at":"2026-08-08T13:02:23.438663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.443334Z","title":null,"venue":null,"work_id":"f6b92c5c-3c7b-443a-a7dd-e40283e25e78","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.442600Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:35ca50eda5bcbc00d8e3120154f16448d0f39831a65cf2e41f81af4c605a7ad3","observation_id":"45ad5809-9fad-4e6e-a9da-ef8b6f6b4418","resolution":{"observed_at":"2026-08-08T13:02:24.446649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.432096Z","title":null,"venue":null,"work_id":"347af6a8-56be-465c-bc21-d6b854eaf0cf","year":2019},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.446073Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:aaf9b986976db87095f7f39b0d1ac5508454ecc8c0f4ee3d657cd98ff67f86d3","observation_id":"9c8b76da-2251-4498-a43b-a4c9a08d14ec","resolution":{"observed_at":"2026-08-08T13:02:24.435254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T13:02:23.449295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.449295Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:e14c7240e1cf536831fcc410c4c03f32f8466fbe1effb8d03bd63fae86d40fbb","observation_id":"ca0d512c-435b-4e2c-8c32-cb7f3321c9d5","resolution":{"observed_at":"2026-08-08T13:02:23.449295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.421527Z","title":null,"venue":null,"work_id":"8023ada3-7bc0-4c0e-905a-c480b6c9cd80","year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.452704Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:7d4f4abb962dcea714a370d5d23b4512946308b0ff69f613ffa18b3e0f84d559","observation_id":"ce4087a6-3f70-4a75-9c3a-b24d32a3f32f","resolution":{"observed_at":"2026-08-08T13:02:24.424986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.411443Z","title":null,"venue":null,"work_id":"50ca8158-d7f5-4641-97be-143d7102fdb2","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.455986Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:e9aad8ec3bd802a794ea5acdc13c25db5e1e53d44a61c9755ab0009bc1eedec0","observation_id":"1c5cbbbe-da44-4578-aa46-6000ae950a0d","resolution":{"observed_at":"2026-08-08T13:02:24.414732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.459603Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.459603Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:4b8689a03db4de290ceaa0272734f208758b779f3906d60dc1f75a0c11b98256","observation_id":"08fbe057-38af-4839-a474-0d85aa937256","resolution":{"observed_at":"2026-08-08T13:02:23.459603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.400756Z","title":null,"venue":null,"work_id":"d73ea5d4-8b42-446c-9a4c-2ef21836853f","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.462660Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:9545c4c1e500bad03addac65df0d21edb24fc9ff257e961fd5a4788fba8c4a5e","observation_id":"7299202c-b1b6-4362-8915-2015d19ffd03","resolution":{"observed_at":"2026-08-08T13:02:24.404561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16137","last_updated":"2024-06-24T21:22:00Z","snapshot_observed_at":"2026-08-07T16:57:45.872655Z","submitted_at":"2023-08-30T16:47:51Z","title":"LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16137","snapshot_observed_at":"2026-08-08T13:02:23.466396Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.466396Z"},"links":{"cited_paper":"/paper/2308.16137","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:9e1b0934988e56dc4f683284b3435e2fa1497284140a8632116891e8693dec0c","observation_id":"9c5bb579-0a93-4f9e-89b4-1066f8227d71","resolution":{"observed_at":"2026-08-08T13:02:23.466396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.389325Z","title":null,"venue":null,"work_id":"34692a75-38d9-4942-9554-51b925e2c378","year":2021},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.470385Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:c295dd6cd15dcea54e3af2e0e6fd01644cd7211acef1e6f73be1a47e516e3128","observation_id":"5338fb71-0e05-4a25-8613-82abf0d085d4","resolution":{"observed_at":"2026-08-08T13:02:24.392896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.378867Z","title":null,"venue":null,"work_id":"197f5fd3-a374-4e1f-8c17-2ba6b98e4863","year":2021},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.474112Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:999cfd4068a04a6fdae2b36ae20b2d67c2de44cc4ec795aab22b9cc97d74d224","observation_id":"74ec9e75-d51c-4dfa-8978-a04f68f537f7","resolution":{"observed_at":"2026-08-08T13:02:24.382465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-08T13:02:23.477263Z","title":"Hinton, Oriol Vinyals, and Jeffrey Dean","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.477263Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:a06858dcaf3ec9887bd2002d900db9cd67152266382f0b44c343807c09329cf6","observation_id":"488345ee-e10b-4c39-bd1e-86ca9d261fe8","resolution":{"observed_at":"2026-08-08T13:02:23.477263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.368132Z","title":null,"venue":null,"work_id":"8efa4147-f9bf-4628-a65a-dac844e18117","year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.480825Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:d7321a49d377ff0fbbe0e747aa1c26305d983737166b860b811551c444255af2","observation_id":"205a9082-2489-4591-8e6f-587a160e3652","resolution":{"observed_at":"2026-08-08T13:02:24.371856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-08T13:02:23.485190Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.485190Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:9af90f0a6503c6c01cb14570fa3c8c7d26d5cd2aafb49faa2d9c8d9d44914959","observation_id":"555a3251-6f50-4498-887c-89a70df4638a","resolution":{"observed_at":"2026-08-08T13:02:23.485190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-08T13:02:23.488961Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.488961Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:ecd07da7c32254e91cb40eab0e4b32bd97dcbbd3fc969c18f6c8c36689f5c1b0","observation_id":"de18bdc6-8cf0-40e6-9c40-2fd30504536e","resolution":{"observed_at":"2026-08-08T13:02:23.488961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00509","last_updated":"2024-09-04T15:55:22Z","snapshot_observed_at":"2026-08-09T04:50:01.251207Z","submitted_at":"2024-08-31T17:19:30Z","title":"LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00509","snapshot_observed_at":"2026-08-08T13:02:23.492987Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.492987Z"},"links":{"cited_paper":"/paper/2409.00509","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:5d4f23b1ca46533d9ba84a5e285058e0e55b2d7006d1400a05c86aaec381d66b","observation_id":"862775c8-f6db-4d05-82ec-2e8f1b986b7c","resolution":{"observed_at":"2026-08-08T13:02:23.492987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T13:02:23.496427Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.496427Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:f569d3163c1927cd46750e73bce85be8a71d44c35f39e9bb867bfd6553dfcde9","observation_id":"73d87952-1a35-4439-8469-83692f0847d6","resolution":{"observed_at":"2026-08-08T13:02:23.496427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10804","last_updated":"2024-07-15T15:20:13Z","snapshot_observed_at":"2026-07-06T18:46:31.112544Z","submitted_at":"2024-07-15T15:20:13Z","title":"Mix-CPT: A Domain Adaptation Framework via Decoupling Knowledge Learning and Format Alignment","version":1},"cited_work":{"arxiv_id":"2407.10804","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.10804","snapshot_observed_at":"2026-08-08T13:02:23.891627Z","title":"Mix-CPT: A Domain Adaptation Framework via Decoupling Knowledge Learning and Format Alignment","venue":"cs.CL","work_id":"bcf5e560-594d-4aa3-9db3-c6cf2763e674","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.499938Z"},"links":{"cited_paper":"/paper/2407.10804","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:fe002b80a9d3514e95f23d2d184599ea0088e2dad8f719e869b3a97aa3e79727","observation_id":"72fb9292-80c8-4985-a431-dfa0bd62ece7","resolution":{"observed_at":"2026-08-08T13:02:23.895811Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.357606Z","title":"Weld, and Luke Zettlemoyer","venue":null,"work_id":"9c787a0b-6f62-4ad3-93fa-e8a03cba6997","year":2017},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.503367Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:30bfe7e449d9535c5d280d62e54fc1e226c65771352e05e5cb934dad71a880c4","observation_id":"6e139a00-6d93-4913-931b-cd20f3a4419c","resolution":{"observed_at":"2026-08-08T13:02:24.361244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.346745Z","title":null,"venue":null,"work_id":"72d34811-c541-40a2-8c3a-7f657ff1ec1a","year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.506337Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:ea71e03c16f1a69f105f8ea0ba8c29b11b5a56a91e83f1155f781ec4286a81ef","observation_id":"2d79aba4-80b2-40cb-8a8c-895f0dba9726","resolution":{"observed_at":"2026-08-08T13:02:24.350470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-07T09:22:20.831075Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-08T13:02:23.510009Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.510009Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:4dfb9a9ac4a15142da2a33410c4774dcd520146b6ed5b46170cd6dbfe708a0cf","observation_id":"79a42152-0190-4603-b725-27843b3580ce","resolution":{"observed_at":"2026-08-08T13:02:23.510009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.514229Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.514229Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:3168d4318b776a8c296f48d185ef4a57eb22c774873dc6f1a7176d0c511538e1","observation_id":"5b04a214-3a0c-4659-bab0-6e958cf527f0","resolution":{"observed_at":"2026-08-08T13:02:23.514229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-08T13:02:23.517219Z","title":"McAuley, Han Hu, Torsten Scholak, S \\' e bastien Paquet, Jennifer Robinson, Carolyn Jane Anderson, Nicolas Chapados, and et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.517219Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:c125e3fd5ddf085d9cf74135899a29726266c9cb8b2a70bf31a9c1ed782cb169","observation_id":"1eb5e699-5d50-4270-93f5-500334a3c508","resolution":{"observed_at":"2026-08-08T13:02:23.517219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-08T13:02:23.521289Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.521289Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:91460341d3cb3e5bee2ec98ee8e593902f0ca9b6442ebc68a0e3129f8a7636ae","observation_id":"b5da2fbb-0732-48af-b934-bc92010432c3","resolution":{"observed_at":"2026-08-08T13:02:23.521289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.329729Z","title":null,"venue":null,"work_id":"bd31760d-dc6b-405a-a416-0e5dc290065c","year":2018},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.525096Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:dae25f0a688559b7070c5995dce1641c5ee84229edb6761056e74e00e7d03413","observation_id":"5c6ca40c-ae67-4ec9-b0c4-a33efe6bb00e","resolution":{"observed_at":"2026-08-08T13:02:24.333069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-08T13:02:23.528753Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.528753Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:0c29608cc372f9470d573d1a9d150f48322e7e7224cb4c4b59ebc1bdc4d6492b","observation_id":"98dc565b-a05c-4681-829d-408531fb4b47","resolution":{"observed_at":"2026-08-08T13:02:23.528753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14679","last_updated":"2024-11-04T17:36:38Z","snapshot_observed_at":"2026-08-08T01:30:40.012013Z","submitted_at":"2024-07-19T21:47:57Z","title":"Compact Language Models via Pruning and Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14679","snapshot_observed_at":"2026-08-08T13:02:23.532389Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.532389Z"},"links":{"cited_paper":"/paper/2407.14679","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:019d2f76da9c487fe6e524f4b0619d47057c07fd967094952a123b0d03b287fa","observation_id":"7dfdd60e-cd85-475c-9a4b-73c899cf5756","resolution":{"observed_at":"2026-08-08T13:02:23.532389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T13:02:23.535671Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.535671Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:805e353bcf1337e73fde9f40d4b6145d7ccec1b6fe1a746cc8747bca10314c7c","observation_id":"f05c5cc8-21ae-4af2-923e-fede0ee399c0","resolution":{"observed_at":"2026-08-08T13:02:23.535671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.318470Z","title":null,"venue":null,"work_id":"0134a5f9-4fb6-4b01-baad-7fb289cff17c","year":2016},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.539461Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:e075dcbe10ce25410676c7efa8a7a65ed04af269efae221614cb0d2bee4ef81e","observation_id":"09b8a079-e146-4bec-9a6c-26f7b905e9c9","resolution":{"observed_at":"2026-08-08T13:02:24.322415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.57967/hf/3372","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.676959Z","title":null,"venue":null,"work_id":"0be85fef-b428-42a8-acb1-b8224464a0ec","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.543895Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:1bfa7ef4b720d7a307f9c64a0ea9fa533ae82438ebf37e61947e27cc421abc39","observation_id":"464df715-05a9-4f0f-bfdb-e22a1c877456","resolution":{"observed_at":"2026-08-08T13:02:23.681862Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17557","last_updated":"2024-10-31T11:37:49Z","snapshot_observed_at":"2026-08-02T15:25:02.551919Z","submitted_at":"2024-06-25T13:50:56Z","title":"The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17557","snapshot_observed_at":"2026-08-08T13:02:23.547421Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.547421Z"},"links":{"cited_paper":"/paper/2406.17557","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:2bd7aa9e52ee1a78b5632c40470f73dcb81021f56551fb88d55391fe70c8b581","observation_id":"d5203d08-e501-47fc-9852-48d94f0d983f","resolution":{"observed_at":"2026-08-08T13:02:23.547421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-08T13:02:23.550716Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.550716Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:10dd4a019549a73677a141744142447684cd8d46eea564c2b78d83633d513679","observation_id":"e39a7522-c89a-4d99-b83c-83b44866625e","resolution":{"observed_at":"2026-08-08T13:02:23.550716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-08T13:02:23.554293Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.554293Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:25055bcd6c9180a2057a41113d6506e42d03b8dcaf16f9d6984a1c3effe8b48a","observation_id":"5da8eaaa-c364-446e-b092-c2af040c0aa2","resolution":{"observed_at":"2026-08-08T13:02:23.554293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10063","last_updated":"2025-05-15T08:05:12Z","snapshot_observed_at":"2026-08-07T15:45:11.003720Z","submitted_at":"2025-05-15T08:05:12Z","title":"CAFE: Retrieval Head-based Coarse-to-Fine Information Seeking to Enhance Multi-Document QA Capability","version":1},"cited_work":{"arxiv_id":"2505.10063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.10063","snapshot_observed_at":"2026-08-08T13:02:23.792624Z","title":"CAFE: Retrieval Head-based Coarse-to-Fine Information Seeking to Enhance Multi-Document QA Capability","venue":"cs.CL","work_id":"9b8b7ad7-90a4-43cf-9c1c-359bebb93382","year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.557640Z"},"links":{"cited_paper":"/paper/2505.10063","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:e574500d1b360b0072b7b324e6a572e94f197d7355d91ff3f8ff840ee2d6bba7","observation_id":"3f0d0a81-245f-4b0e-9760-deda47764884","resolution":{"observed_at":"2026-08-08T13:02:23.796983Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.307989Z","title":"Smith, and Mike Lewis","venue":null,"work_id":"25dd9560-e3aa-4cee-956a-7820bf3f402a","year":2022},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.561507Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:0c0ca316fd98c719ba80ed3d6aa0918ff9332453f1c34a9343e04215af56aed1","observation_id":"6c5a2f6c-7adb-483a-af5f-8b301ace2e85","resolution":{"observed_at":"2026-08-08T13:02:24.311860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.564844Z","title":"Rae, Anna Potapenko, Siddhant M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.564844Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:113560ff500ee4f9e6caed1aff8289404e0bb2bb7e72861aa693511787a8ea2b","observation_id":"c1cf150d-7f9d-41d6-ad88-a61be539c30e","resolution":{"observed_at":"2026-08-08T13:02:23.564844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.291991Z","title":null,"venue":null,"work_id":"ad39fde9-fe39-4420-9515-0bde14b3a0ad","year":2016},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.567885Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:241f0205f6b929c43bd01cf714bf3ef36cd8b9b199c58a8877be2a0e9e34cbc5","observation_id":"42b0fc53-494e-45d0-93a7-a9a3093eb7f0","resolution":{"observed_at":"2026-08-08T13:02:24.295097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.281916Z","title":null,"venue":null,"work_id":"2bae045b-068b-4e5d-8763-681ea81b82f1","year":2019},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.571932Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:d2b47313223735ecd7ef1214d3c0aa35887773e1ac3db202da2262fda8cee19d","observation_id":"d9213b6b-6a9d-49eb-8975-c5f05982ee3a","resolution":{"observed_at":"2026-08-08T13:02:24.285111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.270731Z","title":null,"venue":null,"work_id":"a7a31d40-38e7-4afa-817a-9882abca1602","year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.575295Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:20b84aa5aac652c9e82620d8e3a60187a2df3ff97a7030e52bcc192d49b97b63","observation_id":"51a97ca1-6aa6-4cbf-a1de-8d865d7cc7a8","resolution":{"observed_at":"2026-08-08T13:02:24.274613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.259738Z","title":null,"venue":null,"work_id":"132549a2-fa74-462f-9eea-0a8f925ee4a5","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.578623Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:f7033a58e173f8ca6c7d194ddbfb4e443cbfd20d68a560ac720d67612fdc592c","observation_id":"fe8060f4-14fb-4354-a57e-c86afd1ab445","resolution":{"observed_at":"2026-08-08T13:02:24.263529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.249232Z","title":"Le, Ed H","venue":null,"work_id":"3a659716-9568-4a69-ad38-9abae8959af0","year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.581694Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:6f07653fb16e944ddbeeb5d11fb043890a14c9ce0dd78998d4baff4aa8867390","observation_id":"81128c66-2f9d-400a-bc27-0a82c8f2095b","resolution":{"observed_at":"2026-08-08T13:02:24.252957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.238639Z","title":null,"venue":null,"work_id":"144ffd1a-55c8-431e-a7ca-f616c5074228","year":2019},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.585353Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:798150edbb3453264300cbf6a7df50955d780426335246ae5db2741868a3e0ca","observation_id":"b5de5a26-cd92-4219-8983-706b6f7bc8c9","resolution":{"observed_at":"2026-08-08T13:02:24.242651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05563","last_updated":"2024-07-08T02:39:33Z","snapshot_observed_at":"2026-07-06T18:42:43.011995Z","submitted_at":"2024-07-08T02:39:33Z","title":"LLMBox: A Comprehensive Library for Large Language Models","version":1},"cited_work":{"arxiv_id":"2407.05563","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.05563","snapshot_observed_at":"2026-08-08T13:02:23.776999Z","title":"LLMBox: A Comprehensive Library for Large Language Models","venue":"cs.CL","work_id":"76f7cc5f-7fd4-43a1-9e93-0cc16181732d","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.588790Z"},"links":{"cited_paper":"/paper/2407.05563","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:a7c7f97115e9f3194888930194110d50dc0cf7b6d7880bd16ace290047bff121","observation_id":"ff2a043b-a84d-45fc-a815-8ecbd3169fc5","resolution":{"observed_at":"2026-08-08T13:02:23.781821Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11314","last_updated":"2025-06-11T03:55:09Z","snapshot_observed_at":"2026-08-07T17:04:15.538727Z","submitted_at":"2025-03-14T11:30:37Z","title":"Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11314","snapshot_observed_at":"2026-08-08T13:02:23.592574Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.592574Z"},"links":{"cited_paper":"/paper/2503.11314","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:c6fb80c4568d28bc20742b604149f68087c9da51af5e1f6adf2f603a8214dcdb","observation_id":"e01e48f6-a94f-49db-87f0-a0ca6bb51e23","resolution":{"observed_at":"2026-08-08T13:02:23.592574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.228474Z","title":null,"venue":null,"work_id":"007e3a67-0a7b-45c7-891b-cc88abde4a6b","year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.596080Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:f2faaed33a9839ecd2f46cb222b337ded553bbe662063ece714e19b5d3466f8b","observation_id":"f55cf25d-c492-4106-9797-1f353147a7bf","resolution":{"observed_at":"2026-08-08T13:02:24.231799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.217763Z","title":null,"venue":null,"work_id":"c0a9e0d2-0a9f-4b20-bfee-a21aa35b6fb2","year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.599702Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:02a53ae3c52cbd33048080741273409172f2382bb6fa13d3c96be6da6be2d70f","observation_id":"da0c2b82-5f45-484f-86fe-c7b78cb0c0bf","resolution":{"observed_at":"2026-08-08T13:02:24.221612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T13:02:23.603108Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.603108Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:28ecaf9a95d4f20834c8b8ae3c18bcbce33885e6682393c470377eb759ac7307","observation_id":"7b43d43f-a423-4820-b2f8-8c15d67d7175","resolution":{"observed_at":"2026-08-08T13:02:23.603108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.606462Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.606462Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:618524f8b22e6a25652b7431be4fa97e0dffe59f20bfd90e7b8dbe48412114d4","observation_id":"a9239398-fe6d-4163-8302-233a94274688","resolution":{"observed_at":"2026-08-08T13:02:23.606462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.201077Z","title":null,"venue":null,"work_id":"e855f2ba-765b-47dc-96b5-1c86f2f289f1","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.609891Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:a3adb7b075c385d79187610aa0bb72d1a58b3bcada5766d159f9935a7e3e4ee3","observation_id":"5c2d2108-6022-4c25-83e2-45fb5542a2aa","resolution":{"observed_at":"2026-08-08T13:02:24.204254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11995","last_updated":"2025-05-17T13:13:13Z","snapshot_observed_at":"2026-08-07T15:43:52.911869Z","submitted_at":"2025-05-17T13:13:13Z","title":"Unveiling Knowledge Utilization Mechanisms in LLM-based Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11995","snapshot_observed_at":"2026-08-08T13:02:23.613645Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.613645Z"},"links":{"cited_paper":"/paper/2505.11995","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:3c3d91c04e53c1fea7c4663aafbbbee4f4bde03e2f822b00ac89ec723629a81f","observation_id":"cb8829fa-ee69-49a3-9b9d-187b9478a110","resolution":{"observed_at":"2026-08-08T13:02:23.613645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.190700Z","title":null,"venue":null,"work_id":"6b80ac4a-6eff-4165-b232-e9bd83a4087c","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.617291Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:3f11c4bf51fa6e110ad36d769e57a906e398d15373916e88e6c82bc75a683abf","observation_id":"b89bb756-ca0f-4060-a8b6-327097f02bdd","resolution":{"observed_at":"2026-08-08T13:02:24.194318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01364","last_updated":"2024-02-07T07:14:39Z","snapshot_observed_at":"2026-08-04T18:35:41.659861Z","submitted_at":"2024-02-02T12:34:09Z","title":"Continual Learning for Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01364","snapshot_observed_at":"2026-08-08T13:02:23.620761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.620761Z"},"links":{"cited_paper":"/paper/2402.01364","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:aecd5ea9c33ba2051546e8012f36bde60177f039724b958b99c962c379468173","observation_id":"0c8805af-1584-4276-9ae2-cf5b9fbdd591","resolution":{"observed_at":"2026-08-08T13:02:23.620761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-08T13:02:23.624877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.624877Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:d1e9070dcfaecf0b2dfd178ae74f8881d60e4cee79a77143cc3d47c2282fc5d4","observation_id":"07106f01-726e-4ed1-9b83-3a3a5403e4e1","resolution":{"observed_at":"2026-08-08T13:02:23.624877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.180616Z","title":null,"venue":null,"work_id":"03a297bb-0c9a-4828-9ffe-6fbe864f2a33","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.628533Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:5386bd1bba03d0d3758cbd7f56dd4956f9aa881611176f420b421fd9186694b0","observation_id":"2eb6b51b-caa0-49c1-bce8-b5d1b92a3288","resolution":{"observed_at":"2026-08-08T13:02:24.183851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-08T13:02:23.632502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.632502Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:fa9e4f6ef51ea0c9e147374b71fe13426f37bae51b80da64caa8f9487c6e606c","observation_id":"ba6e6528-17c8-45b2-a0b2-8516fca611bb","resolution":{"observed_at":"2026-08-08T13:02:23.632502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-08T13:02:23.636276Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.636276Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:8908f580381c0a9090c2fe05c8075ec4e34ef49b397bdf60251ff2c5f6c1668b","observation_id":"95b53572-3686-4fb0-8cef-1dce3f78fed6","resolution":{"observed_at":"2026-08-08T13:02:23.636276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-08T13:02:23.640079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.640079Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:2e4262657d5765a35e69ec458b2328b3ffae359cd6f74edda09ed7d1d9d02082","observation_id":"5facfe1c-fbc9-40fe-938b-35110551efa7","resolution":{"observed_at":"2026-08-08T13:02:23.640079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-08T13:02:23.644176Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.644176Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:2bf46bc6010f8860206bbb3a89187f9b2cbf033e6a6f6547bce6e59ed8561d7c","observation_id":"1dccdb8f-b261-4004-86fb-51e4216a416d","resolution":{"observed_at":"2026-08-08T13:02:23.644176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:24.170770Z","title":null,"venue":null,"work_id":"47fecc59-29b4-4db7-89cf-eed27411f4a6","year":2024},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.647984Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:efe94aa0736345614776e695e81856330b883731dcb986174c1f3e4f4c071151","observation_id":"937f6976-4d89-4ed4-b575-5e1d60adfdf5","resolution":{"observed_at":"2026-08-08T13:02:24.174044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.651908Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.651908Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:0a4e3b16dab420c6c3b7d1e4a3701fbe3d21ad19cf3e6bd13b1594beb11ec654","observation_id":"3a2d0976-941d-4719-81d2-42345d806fa1","resolution":{"observed_at":"2026-08-08T13:02:23.651908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:02:23.655720Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-08T13:02:23.655720Z"},"links":{"citing_paper":"/paper/2502.07365"},"observation_digest":"sha256:0a99705579b239bee80adb885e46686a66244653aa8f4a5a0d7b8b6f588d8a07","observation_id":"a004a6cf-140e-4a4a-9bf1-048b389df015","resolution":{"observed_at":"2026-08-08T13:02:23.655720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T03:30:26.149584Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":6,"verified_fuzzy":4},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2502.07365."}