{"as_of":"2026-08-23T01:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed98e988c4522c15a029744248f278ccd4d67c3cd236a14db6d7959d745fadfb","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:06:21.682241Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T06:07:36.830550Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T06:11:20.403487Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"cited_work":{"arxiv_id":"2505.11166","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11166","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solopo: Unlocking long-context capabilities in llms via short-to-long preference optimization.arXiv preprint arXiv:2505.11166","venue":null,"work_id":"793e1702-ac86-4ec7-b99e-7635b0948440","year":null},"citing_paper":{"arxiv_id":"2604.17535","last_updated":"2026-04-19T16:53:56Z","snapshot_observed_at":"2026-08-13T17:23:59.909337Z","submitted_at":"2026-04-19T16:53:56Z","title":"OPSDL: On-Policy Self-Distillation for Long-Context Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T06:07:36.830550Z"},"links":{"cited_paper":"/paper/2505.11166","citing_paper":"/paper/2604.17535"},"observation_digest":"sha256:6dc107c2078abd59d01fb53a33b182b6ff2aabc268852fdd0a54f3a86b022fe9","observation_id":"401592e4-5322-4dd6-81c0-5d0a9dcb878f","resolution":{"observed_at":"2026-06-04T02:07:03.503226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.11166/citation-record","integrity":"/paper/2505.11166/integrity","json":"/paper/2505.11166/citation-record.json","paper":"/paper/2505.11166"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.287572Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.287572Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:05960337f02dbbb576b09b53fa94a6cf7634b84c4590683003c7b510a8e9b1ae","observation_id":"c4f53665-b4c7-46ac-85a3-0e29ffabc915","resolution":{"observed_at":"2026-08-15T21:06:21.287572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.297575Z","title":"Unifying cross-lingual summarization and machine translation with compression rate","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.297575Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:5ead8871ecfb41565765c48e70fa0590d9bb20a5041ed1911f7f88ffb66d0840","observation_id":"50f25e68-8a31-40ed-88f7-f69ee8f07547","resolution":{"observed_at":"2026-08-15T21:06:21.297575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.338","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.927948Z","title":"CItruS: Chunked instruction-aware state eviction for long sequence modeling","venue":null,"work_id":"b1a3f5ee-bcf0-48fa-8a4c-9ca89e9547e1","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.308569Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:f6021eab1c33776465f6a371ab0de68937505d5146b21f47bf26173f4e8badf0","observation_id":"321dcabc-c338-412e-9745-145c6390b12d","resolution":{"observed_at":"2026-08-15T21:06:21.931963Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.313134Z","title":"LongAlign: A recipe for long context alignment of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.313134Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:364f08f3c37dc2c871da3ebbbacf9b5e9e331748360b073c485ff6d348ebe2a8","observation_id":"11500c01-8f75-4510-b022-87f70d5f7911","resolution":{"observed_at":"2026-08-15T21:06:21.313134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.317522Z","title":"LongBench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.317522Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:91af6cf06606d6e32d2411be494d0ab60869019c4e127ac648dace0c82377835","observation_id":"66a26a42-e044-4bf9-9533-5cd68f07d188","resolution":{"observed_at":"2026-08-15T21:06:21.317522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-12T12:34:50.226758Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-15T21:06:21.321988Z","title":"Longbench v2: Towards deeper understanding and reasoning on realistic long-context multitasks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.321988Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:e020a3530f5f23e695769a542429dffc62e8f3c520c95b636e26bb0e9184926a","observation_id":"ea7e55a8-00ce-4a44-96c6-3cda48e65be6","resolution":{"observed_at":"2026-08-15T21:06:21.321988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.326027Z","title":"Longwriter: Unleashing 10,000+ word generation from long context LLMs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.326027Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:42a6ae959a385be00e05cbc86863372c150a764326c3266a8b52a63a54b3dfcc","observation_id":"56d46e58-0eb1-462e-99bd-7a7d72042d52","resolution":{"observed_at":"2026-08-15T21:06:21.326027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.329421Z","title":"Luna: A lightweight evaluation model to catch language model hallucinations with high accuracy and low cost","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.329421Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:cab09f09edbac4b4a1497e3c6fcc716792830b4736cd23a82c31cba65777199c","observation_id":"51b86b48-fcf2-4f56-835e-0b333994341a","resolution":{"observed_at":"2026-08-15T21:06:21.329421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15280","last_updated":"2024-12-18T04:08:18Z","snapshot_observed_at":"2026-08-17T08:41:34.720199Z","submitted_at":"2024-12-18T04:08:18Z","title":"Context-DPO: Aligning Language Models for Context-Faithfulness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15280","snapshot_observed_at":"2026-08-15T21:06:21.333355Z","title":"Context- dpo: Aligning language models for context-faithfulness.CoRR, abs/2412.15280, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.333355Z"},"links":{"cited_paper":"/paper/2412.15280","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:7b061df25aa13cda2b325c9e2ddf77e448ef37bef53b450d7311861ca8eded8e","observation_id":"3ab93836-3b06-485c-b764-c8e80f7dc7b5","resolution":{"observed_at":"2026-08-15T21:06:21.333355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.337415Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.337415Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:e855a949d1107a127440464b80f97abc310391a9a1020aa90e0c39f576a74bf1","observation_id":"59aa538a-0ed0-4da0-8ece-95846396d7f5","resolution":{"observed_at":"2026-08-15T21:06:21.337415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.340734Z","title":"LongPO: Long context self-evolution of large language models through short-to-long preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.340734Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:9563de3ef3ff0e490b9c179e50b06f23604e0e4106fd4262b63c28a3d4ac5739","observation_id":"b8869fc9-9c52-484c-9693-7fbcd9f45470","resolution":{"observed_at":"2026-08-15T21:06:21.340734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.344025Z","title":"LongloRA: Efficient fine-tuning of long-context large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.344025Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2eb6f77c1c5b337c609aaa5f6896f7ed87480d63f1de6eacd72b51f9874be1f7","observation_id":"a4ca1c02-8e36-429a-9e58-8d740d7c2e31","resolution":{"observed_at":"2026-08-15T21:06:21.344025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-15T21:06:21.347826Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.347826Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2b955b9f2075742ece14f847f320764b9679b3d9b2f8ff5d3135d8e47e4ad156","observation_id":"0d5d4a65-3291-41c8-ab84-6cc638913e68","resolution":{"observed_at":"2026-08-15T21:06:21.347826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.351982Z","title":"Smith, and Matt Gardner","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.351982Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:4daeb2a1b0dff307359bd4829f63104379ee898a77070bcaedd59da3692c98be","observation_id":"2481da52-7be7-484e-b2ff-a47dec067b2f","resolution":{"observed_at":"2026-08-15T21:06:21.351982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14502","last_updated":"2025-06-10T07:17:21Z","snapshot_observed_at":"2026-08-21T13:52:22.525008Z","submitted_at":"2023-02-28T11:34:30Z","title":"A Survey on Long Text Modeling with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14502","snapshot_observed_at":"2026-08-15T21:06:21.355585Z","title":"A survey on long text modeling with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.355585Z"},"links":{"cited_paper":"/paper/2302.14502","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:4806c23d92c59b4544554186d89aa967af11c79b8e347a761d6d92e5caed5a81","observation_id":"9e4a7a43-0673-4a1a-8247-121571271f8a","resolution":{"observed_at":"2026-08-15T21:06:21.355585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07365","last_updated":"2025-05-28T08:04:23Z","snapshot_observed_at":"2026-08-20T00:02:22.293470Z","submitted_at":"2025-02-11T08:37:16Z","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07365","snapshot_observed_at":"2026-08-15T21:06:21.360895Z","title":"Longred: Mitigating short-text degradation of long-context large language models via restoration distillation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.360895Z"},"links":{"cited_paper":"/paper/2502.07365","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:6904c6261d3926881ba97ee7999e9635784fe885965feeea2a10df160d426c23","observation_id":"fade82b0-368b-4e18-af54-4af488960c82","resolution":{"observed_at":"2026-08-15T21:06:21.360895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T21:06:21.365652Z","title":"Ahmad Al-Dahle","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.365652Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2ede483fbe70e03a0ff2b914159df543ea16f547d864541130eeb9e4285ba1d3","observation_id":"1feec261-6e05-4325-b823-57e9383eb807","resolution":{"observed_at":"2026-08-15T21:06:21.365652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.369420Z","title":"What is wrong with perplexity for long-context language modeling? InThe Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.369420Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2673cf080cdd8019e906acf43426f1f5fed82d0adca87c558a8b962360adab4b","observation_id":"e0edc79e-c9b6-4a07-b186-bcba7152b21c","resolution":{"observed_at":"2026-08-15T21:06:21.369420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.373009Z","title":"Open llm leader- board v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.373009Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:b7e94946b6e559799c724b2e8a89e415eb1dad15889ef5a10dbc37351c36b13b","observation_id":"a27871c9-4476-414f-8f1b-05dfe229e00c","resolution":{"observed_at":"2026-08-15T21:06:21.373009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.376538Z","title":"Data engineering for scaling language models to 128k context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.376538Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:74708fe23e5063a88cc46b3600e74425e0b8c638a846a9ac2e1a0069e293683e","observation_id":"35d1c77e-a666-48e7-b37e-0c3d58aa3571","resolution":{"observed_at":"2026-08-15T21:06:21.376538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.380547Z","title":"How to train long-context language models (effectively)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.380547Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:c756f89295266f74664329d83fb4d358e4da30b16102f09a09f6c5cfe4901633","observation_id":"b7a683b8-e35a-4cd3-9387-fd7db4173c3b","resolution":{"observed_at":"2026-08-15T21:06:21.380547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.384297Z","title":"How to train long-context language models (effectively), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.384297Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:32858ca1d48b06f9159a55c9cc83193ecc79310e75c3b8e98b6820894f00287f","observation_id":"52c67a86-e965-4a58-abf8-9c6271cdc260","resolution":{"observed_at":"2026-08-15T21:06:21.384297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.387800Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.387800Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:d324e344deb851b979eb0dac788b9f57fdabc99608489324172a6e7d351f5768","observation_id":"065e54ff-13f2-4898-ae24-09197a77bbea","resolution":{"observed_at":"2026-08-15T21:06:21.387800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.813102Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":"d5002b19-75ae-43e2-b689-2d4ae252f85f","year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.391260Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:f916cf0517e44b1b97d3ea5294255e9ebd08cc915dd6168de97daca4e3e6489d","observation_id":"a26a5ab3-843c-425d-acc5-73433f8835de","resolution":{"observed_at":"2026-08-15T21:06:22.817391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.800374Z","title":"Two stones hit one bird: bilevel positional encoding for better length extrapolation","venue":null,"work_id":"4bef74d5-846f-4fbf-ac59-038b0c2bd91d","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.394973Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:723534ea058feb7cbc134cd0991a693e205563f6d456113192c05a84f17aa0d8","observation_id":"e9a5b1c8-669d-4cec-93d2-f760c180d162","resolution":{"observed_at":"2026-08-15T21:06:22.804718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-08-21T04:25:41.592030Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-15T21:06:21.398494Z","title":"Measuring mathematical problem solving with the math dataset, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.398494Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:28faaf4e17b56571fe1351c01b69a70c272b0b379d84e898fca8dd22e771ef83","observation_id":"3997cc7e-3d58-4c9e-bf2f-796c8a1d61fb","resolution":{"observed_at":"2026-08-15T21:06:21.398494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.402718Z","title":"Improving long context document-level machine translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.402718Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:c942710fb818f2f21c49d9fa7140298123f69227ba96c4e8b5d11f9cef18bb8e","observation_id":"fadf7f49-889f-474b-ba40-67b0cb1fac51","resolution":{"observed_at":"2026-08-15T21:06:21.402718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.406422Z","title":"Constructing a multi-hop QA dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.406422Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:04dfbbb677aa8f36e91119588af942380668a6499a449442894f7c378b20e5c7","observation_id":"2efbadcd-b722-42da-a661-31e8210c58c5","resolution":{"observed_at":"2026-08-15T21:06:21.406422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.409833Z","title":"ORPO: Monolithic preference optimization without reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.409833Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:3489e51582607f3a495fcb657824626deb003f0bff714cbf9311c7b85d5f0581","observation_id":"bab910bd-d6d3-403a-a56c-6e6cbdab86a0","resolution":{"observed_at":"2026-08-15T21:06:21.409833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.413167Z","title":"RULER: What’s the real context size of your long-context language models? InFirst Conference on Language Modeling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.413167Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:71f7c33d61a0415aac0140dfcf30352d2b6b890ba087eb841f0ebb0fe7a00ea1","observation_id":"0d0a6897-d98d-4b99-b3fc-ca98eedb7816","resolution":{"observed_at":"2026-08-15T21:06:21.413167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.416410Z","title":"Fewer is more: Boosting math reasoning with reinforced context pruning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.416410Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:9128270f8993a7cc4e7bd01678cd17edb9ca2cb6d4f73e574652789fa39b7276","observation_id":"79ac3bf2-a78e-46ff-8aaa-f542247aebf4","resolution":{"observed_at":"2026-08-15T21:06:21.416410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-20T06:29:44.483696Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-15T21:06:21.419979Z","title":"Deepspeed ulysses: System optimizations for enabling training of extreme long sequence transformer models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.419979Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:d08481450a9bb1c37e4e572f5ed918d8f31999a82453be80fedb0860aee25b1e","observation_id":"919931ce-cf80-4df9-be3c-625b4596fcba","resolution":{"observed_at":"2026-08-15T21:06:21.419979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T21:06:21.423777Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.423777Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:1d5d2809fd45d748de7f402562a1eb3edfbf379d8bd219810410984edff41449","observation_id":"74afce17-8d91-4ff3-9c03-1477b9532a83","resolution":{"observed_at":"2026-08-15T21:06:21.423777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.427797Z","title":"The NarrativeQA reading comprehension challenge.Transactions of the Association for Computational Linguistics, 6:317–328, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.427797Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:3019eed749e8950cdc14049153fac07afd57117bf19932dac62514cb2fbb6293","observation_id":"10423ee0-da8a-469d-9caa-44979560b076","resolution":{"observed_at":"2026-08-15T21:06:21.427797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.781965Z","title":"Babilong: Testing the limits of llms with long context reasoning-in-a-haystack","venue":null,"work_id":"10980547-8810-4db9-86bf-5033a8f3a7e2","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.432249Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:78f4cb813a24ace2a304964e94aece39f1c8408400bf9a88ad4ceb649933aeba","observation_id":"251ae323-563d-4083-9c3a-e87e54e9b168","resolution":{"observed_at":"2026-08-15T21:06:22.786196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.768740Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural lan- guage generation, translation, and comprehension","venue":null,"work_id":"4a62b05b-9f9d-47bb-b7d5-084bdb7caf84","year":2019},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.436524Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:13861222ce1ff26a7fd8434d49f741053dfa5d01f9ed75f1f01795daa4756ce3","observation_id":"09f00ea0-30d3-401b-ac34-e5cc7d3f1e70","resolution":{"observed_at":"2026-08-15T21:06:22.773554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.440458Z","title":"Fundamental capabilities and applications of large language models: A survey.ACM Comput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.440458Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:1162df74261e70d3529127343e8ecd1f1b89f9b737f08dd9ec5514f98e3af49f","observation_id":"1b5592b0-42f7-42a1-8e89-6fde66ce2232","resolution":{"observed_at":"2026-08-15T21:06:21.440458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11681","last_updated":"2025-05-14T14:01:23Z","snapshot_observed_at":"2026-08-17T14:56:41.818758Z","submitted_at":"2024-11-18T16:03:51Z","title":"PSPO*: An Effective Process-supervised Policy Optimization for Reasoning Alignment","version":3},"cited_work":{"arxiv_id":"2411.11681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11681","snapshot_observed_at":"2026-08-15T21:06:22.177325Z","title":"PSPO*: An Effective Process-supervised Policy Optimization for Reasoning Alignment","venue":"cs.AI","work_id":"38b06f98-53fb-406f-913c-a56ea4054076","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.444253Z"},"links":{"cited_paper":"/paper/2411.11681","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:8812aec1cebfedf83d9512c3f2154043f87b65c352a7b2218d168998711546e3","observation_id":"625b7171-e13e-4332-9566-8c078399fdcb","resolution":{"observed_at":"2026-08-15T21:06:22.181532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.135","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.857249Z","title":"Making long-context language models better multi-hop reasoners","venue":null,"work_id":"6e49207d-8eac-48b7-838e-659b4d2945a9","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.447870Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:29b313840332624c6df438fc5d45c5458077cd25e3b06455c6b65ae4b6ff560f","observation_id":"563bd622-0fbf-4fe0-9c15-92456885cb30","resolution":{"observed_at":"2026-08-15T21:06:21.861204Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.451694Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.451694Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:7f2cf0ea20d2606a2f793c5fae7b9fe07b9acaecdd9c3167ad3dbcc66ff5ac2c","observation_id":"0bfd3b9f-87cb-4c75-84fe-eaff1d4905ca","resolution":{"observed_at":"2026-08-15T21:06:21.451694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.455879Z","title":"SnapKV: LLM knows what you are looking for before generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.455879Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:06aec0211e694e2cb8fbe4295ea82a393731c5c7c692b6140982591425193d0a","observation_id":"ff924a2d-3838-4d0e-8fbd-5e4238a6f418","resolution":{"observed_at":"2026-08-15T21:06:21.455879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23463","last_updated":"2025-04-28T21:14:31Z","snapshot_observed_at":"2026-08-16T14:45:17.327504Z","submitted_at":"2024-10-30T21:08:07Z","title":"MDCure: A Scalable Pipeline for Multi-Document Instruction-Following","version":3},"cited_work":{"arxiv_id":"2410.23463","doi":"10.48550/arxiv.2410.23463","metadata_source":"pith","pith_arxiv_id":"2410.23463","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"MDCure: A Scalable Pipeline for Multi-Document Instruction-Following","venue":"cs.CL","work_id":"e81b7da3-0102-4a6a-87d3-edc9d203a901","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.459722Z"},"links":{"cited_paper":"/paper/2410.23463","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:73c0b2acceae5979b620f232cec99402904a7049c8a09c871140d67caa183242","observation_id":"ea3b987e-acdf-4b55-ac8e-e83dbb7f2fc8","resolution":{"observed_at":"2026-08-15T21:06:21.842018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.747731Z","title":"A comprehensive survey on long context language modeling","venue":null,"work_id":"0cd18099-8840-4ff9-be2a-d58ee21d7f04","year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.463912Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:361a6ab2dd7410b9963c887572095a457ef6527cae63e9bfbef50cdc6e20569c","observation_id":"b63d8b18-e504-41a8-ac88-5dde435dd145","resolution":{"observed_at":"2026-08-15T21:06:22.751632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.467936Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.467936Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:72e1e8f67c1208636a518b309b2912f747c0b4734f79f8308a596778e991cb6c","observation_id":"97ef50cd-29cf-4fc6-9e73-e8069ca1d66c","resolution":{"observed_at":"2026-08-15T21:06:21.467936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13189","last_updated":"2025-02-18T14:06:05Z","snapshot_observed_at":"2026-08-12T19:30:23.025771Z","submitted_at":"2025-02-18T14:06:05Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13189","snapshot_observed_at":"2026-08-15T21:06:21.471878Z","title":"Zhang, Zhilin Yang, Xinyu Zhou, Mingxing Zhang, and Jiezhong Qiu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.471878Z"},"links":{"cited_paper":"/paper/2502.13189","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:ea423067e1ba0238ad44bccd51edbcab4509db62c8365b7c73b81b044aa8a72d","observation_id":"6ff09e3e-5d2c-4e24-a198-efcd65399a6a","resolution":{"observed_at":"2026-08-15T21:06:21.471878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-16T15:02:10.343729Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-15T21:06:21.476220Z","title":"When less is more: Investigating data pruning for pretraining llms at scale, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.476220Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:449fddc7afb6ad4ebd0a37cc4066b9db3cefffbc9e5dadd8432fbd413339e130","observation_id":"bb756b43-6729-4e29-a0ac-6c0d4e32f8a2","resolution":{"observed_at":"2026-08-15T21:06:21.476220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.726383Z","title":"SimPO: Simple preference optimization with a reference-free reward","venue":null,"work_id":"97251e64-65da-4931-b154-6d368aaa81ec","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.480122Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:a0cb65be0feea474c7b8f7806025a6c61fb84a8048f0990eb586f524b768c63a","observation_id":"3beb0357-2152-4fb4-91ac-edfd83b20d49","resolution":{"observed_at":"2026-08-15T21:06:22.731953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.714103Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"7ab079b8-afd7-4a3d-88ea-1c216b2ad69c","year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.483717Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:1a55f84f2eca83287ef21f773b69de8647f1a071565a9211a100a0a43e4bc5dd","observation_id":"67558fb0-8f55-41cf-b6ce-77d4553746c4","resolution":{"observed_at":"2026-08-15T21:06:22.718328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.488823Z","title":"Vicky Zhao, Lili Qiu, and Dongmei Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.488823Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:eb03ada1a986f789580734d75838f85990eeef0fe9328ee922727c614ff26057","observation_id":"d8ca97d2-d082-4236-9627-0fa09848f9f9","resolution":{"observed_at":"2026-08-15T21:06:21.488823Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.493201Z","title":"YaRN: Efficient context window extension of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.493201Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:c04b0ea3a35c6f1fc814f51105b78b1b90d48cc0809d89fc18b39894dd834992","observation_id":"4a933ae7-cec9-4b42-a662-a2010e2ce6f0","resolution":{"observed_at":"2026-08-15T21:06:21.493201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.684321Z","title":"Handling Very Long Contexts in Neural Machine Translation: a Survey","venue":null,"work_id":"e5c56de1-655a-4b2a-aaef-77c26083517e","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.502109Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:81c4b4ddb90e235da2fddb90092d3aadcd83e90b2be99f78d9312f92a04cd6ce","observation_id":"a8154c0d-8865-4710-9146-983fe574b3c5","resolution":{"observed_at":"2026-08-15T21:06:22.688508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.672745Z","title":"Infobatch: Lossless training speed up by unbiased dynamic data pruning","venue":null,"work_id":"638cac3b-bad3-41f0-83b4-e366ab4bb16a","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.506022Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:53fb861d6f3dad5ad84221f847d196b150eaa1d7e5b005eadb2d0122ab0648fe","observation_id":"de4410f3-6d63-4499-853f-f7b6bf1b1f63","resolution":{"observed_at":"2026-08-15T21:06:22.676606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-15T21:06:21.510415Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.510415Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:0b64c07e6bc3ddb389e08b2939eff70e2554854e854851e16e8e273152db22da","observation_id":"28999005-27d5-4b0a-a3aa-3dc4b198dfa5","resolution":{"observed_at":"2026-08-15T21:06:21.510415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-15T21:06:21.522867Z","title":"Zero: Memory optimizations toward training trillion parameter models, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.522867Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:01ca1de10681848dcc51dcc1e2ee3c11695236662ac725974b50ea7e29d2da86","observation_id":"ef0fe2ee-8f47-47e9-b086-1b3a71c86f96","resolution":{"observed_at":"2026-08-15T21:06:21.522867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.527301Z","title":"SQuAD: 100,000+ questions for machine comprehension of text","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.527301Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2b270feb9e9d7b1b75e4c5ba9750b17e204b19bb05417e715307d9a2e7316b6c","observation_id":"ae96f388-7aa7-476b-bf48-e23d1b7b8143","resolution":{"observed_at":"2026-08-15T21:06:21.527301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-21T17:04:32.090035Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-15T21:06:21.532177Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.532177Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:aa014b436071a79a6cfba45908e097dc03082ef0f5fb0004bbcde3350a9532d0","observation_id":"ae3ae815-e323-4bbb-86b5-782aca30583f","resolution":{"observed_at":"2026-08-15T21:06:21.532177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.654501Z","title":null,"venue":null,"work_id":"aee3c24c-6a3b-430a-9139-86da49302049","year":1951},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.537001Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:71cabb820673dc10e1d56b54a49ad0e101b4e3a3446774a9b69187ed0ae6ce25","observation_id":"fecc4298-f24e-4cee-9d61-3d1146fd47a0","resolution":{"observed_at":"2026-08-15T21:06:22.658195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-08-21T02:25:44.454471Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-15T21:06:21.541137Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.541137Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:c4eae45d26fa8657aeed0a352cd6dc763366498462f52bb903710a1fbe533d77","observation_id":"bf4f98c5-4af6-4ebd-ad01-b5072f34c0e3","resolution":{"observed_at":"2026-08-15T21:06:21.541137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.643420Z","title":"Generalized preference optimization: A unified approach to offline alignment","venue":null,"work_id":"83001b3f-af57-475d-9829-037380745918","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.545856Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:f0534d65ad5cd602c3129bed9962e1900d5b207e51ffa6343874674838255c70","observation_id":"8bc4674d-699f-4116-936b-361c00f14c1d","resolution":{"observed_at":"2026-08-15T21:06:22.647333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18533","last_updated":"2024-10-24T08:27:26Z","snapshot_observed_at":"2026-08-16T13:06:22.189309Z","submitted_at":"2024-10-24T08:27:26Z","title":"LOGO -- Long cOntext aliGnment via efficient preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18533","snapshot_observed_at":"2026-08-15T21:06:21.549930Z","title":"LOGO - long context alignment via efficient preference optimization.CoRR, abs/2410.18533, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.549930Z"},"links":{"cited_paper":"/paper/2410.18533","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:0973c8a78da01dc9c748f43444f8a1661262e4804a11039b86f6f04ccce1643c","observation_id":"371e2cfc-b42a-4ba8-96a3-e5a0ee3f2b0b","resolution":{"observed_at":"2026-08-15T21:06:21.549930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.553894Z","title":"Musique: Multihop questions via single-hop question composition.Transactions of the Association for Computational Linguistics, 10:539–554, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.553894Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:c05d64dc73cdb113edf482944ef52ccc9a65c136a6dccc03713d241b38c26ba9","observation_id":"b2108d74-9dfe-4810-823b-e5b26ba5db3b","resolution":{"observed_at":"2026-08-15T21:06:21.553894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.557707Z","title":"Leave no document behind: Benchmarking long-context LLMs with extended multi-doc QA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.557707Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:7fd50f23093cf026a8ece7eb4093db00ca3457bfea91c1892915b5063d302044","observation_id":"43fc8ca2-f7c8-442f-825a-1c42138e4f9e","resolution":{"observed_at":"2026-08-15T21:06:21.557707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-20T16:26:42.002863Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-15T21:06:21.561955Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.561955Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:85dc434d7ed2d0026cc3ab92285fe7de86b319d1ce6676ca7c14fa3cd512cbd7","observation_id":"443c3306-3e0a-4667-acf9-f9919d2bc10b","resolution":{"observed_at":"2026-08-15T21:06:21.561955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.623621Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":"866859ab-fb1f-4a85-94b4-84d31ef3a3c0","year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.565886Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2735fac905f95ccc3721173f59bbfc9a2b4752561b4610f48180021b63236f72","observation_id":"8399af25-98bb-4eb4-ae1d-1f4eca0b9a84","resolution":{"observed_at":"2026-08-15T21:06:22.628552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.611809Z","title":"Kullback–Leibler divergence","venue":null,"work_id":"f4561e8c-1bd7-44d3-a719-56e520190e71","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.569471Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:114c374918478b734c6f13d4bdab10d806cd87a05ce532528fbfed67c86eb806","observation_id":"6059e6b7-97e0-403e-a987-fe68453342a2","resolution":{"observed_at":"2026-08-15T21:06:22.615703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.601312Z","title":"Wit and Marie Gillette","venue":null,"work_id":"48d99e03-eedc-44dc-9ba7-c9bc3106e877","year":2013},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.573105Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:7d157ad139fe952a197da4ff97640c00bd930f6ed2f1aced065a1d3cf9f7b455","observation_id":"49b05a65-9a5d-454d-8bd5-7e924200befe","resolution":{"observed_at":"2026-08-15T21:06:22.604784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.590475Z","title":"An efficient recipe for long context extension via middle- focused positional encoding","venue":null,"work_id":"df403f8f-06fc-4d4a-9e6b-d0ec064bc83a","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.576890Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:c4f22034f58b02bf0343783d66bde8b41e6becf6128cd328d8b75e1ea49a6b1a","observation_id":"505c72a8-e97f-420f-84dc-ec67e3eae96f","resolution":{"observed_at":"2026-08-15T21:06:22.594373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.580733Z","title":"Effective long-context scaling of foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.580733Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:b201dda025cf16b77a58d162fe2e790cf595f00602f2c36674d1309d64592047","observation_id":"414a2203-ee51-4946-b2e3-9f5bb1264a36","resolution":{"observed_at":"2026-08-15T21:06:21.580733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.584357Z","title":"Large language models for generative information extraction: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.584357Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:a3232ba79ee0889a00bf7eb88206c3c2f4ee942078539f1c26555c8edd807197","observation_id":"8cce9127-4172-4fea-83e7-ff025a3d6794","resolution":{"observed_at":"2026-08-15T21:06:21.584357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.564125Z","title":"RECOMP: Improving retrieval-augmented LMs with con- text compression and selective augmentation","venue":null,"work_id":"edf1b8e8-d324-491f-bfbb-554276fb4d51","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.587957Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:4fb585ab7cc213446ebe26dc5fa8113811c4a331780dac46a360baaba73ed885","observation_id":"ef386735-cb16-414a-9306-7b121d41d857","resolution":{"observed_at":"2026-08-15T21:06:22.568096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12583","last_updated":"2025-05-29T06:01:22Z","snapshot_observed_at":"2026-08-16T12:57:26.813567Z","submitted_at":"2025-02-18T06:40:23Z","title":"LongFaith: Enhancing Long-Context Reasoning in LLMs with Faithful Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12583","snapshot_observed_at":"2026-08-15T21:06:21.591936Z","title":"Longfaith: Enhancing long-context reasoning in llms with faithful synthetic data.CoRR, abs/2502.12583,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.591936Z"},"links":{"cited_paper":"/paper/2502.12583","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:a9ab527eae656d2e11fdb4f325f91de11c4256e9047e5d66d5da13e8ba82e970","observation_id":"0832a35e-eece-4803-b931-2251f5ef98d8","resolution":{"observed_at":"2026-08-15T21:06:21.591936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T21:06:21.600241Z","title":"Qwen2.5 technical report.ArXiv, abs/2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.600241Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2382a59f9605a67764f8682d74dd1ffd0e1cf7769a509045e0690982ce7b2740","observation_id":"1a79735a-77f7-49a6-9ef7-68c09f2c17a0","resolution":{"observed_at":"2026-08-15T21:06:21.600241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.553119Z","title":"Mindllm: Lightweight large language model pre-training, evaluation and domain application.AI Open, 5: 1–26, 2024","venue":null,"work_id":"39ce29e5-449a-4914-8f04-7a3300d7f378","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.604178Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:2189a994db48f105120ebfd165a514cbd302e887b038f991799897ae65dfd21a","observation_id":"ccc194f9-4edd-4fe2-9940-e9dd6ed15fcb","resolution":{"observed_at":"2026-08-15T21:06:22.556789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.608200Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.608200Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:feffca4ccd433c1cc5a9f41dab60d6b9f76cded7cc4fee945ae0d72c64a5a1b4","observation_id":"35f54b63-142f-4928-b67a-47f4b80787f3","resolution":{"observed_at":"2026-08-15T21:06:21.608200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.542121Z","title":"Longcite: Enabling LLMs to generate fine-grained citations in long-context QA,","venue":null,"work_id":"d89eb063-1740-44d0-8b10-7327cc9b09bc","year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.611974Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:eb3c8dfaaf01732e8948058670e59e09f0b604a424273abbc4c7170cc1b1d131","observation_id":"5384a0cb-441d-4438-94b5-26ccc5be58c8","resolution":{"observed_at":"2026-08-15T21:06:22.546000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21252","last_updated":"2024-10-28T17:50:42Z","snapshot_observed_at":"2026-08-19T22:13:48.860382Z","submitted_at":"2024-10-28T17:50:42Z","title":"LongReward: Improving Long-context Large Language Models with AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21252","snapshot_observed_at":"2026-08-15T21:06:21.620099Z","title":"Longreward: Improving long-context large language models with AI feedback.CoRR, abs/2410.21252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.620099Z"},"links":{"cited_paper":"/paper/2410.21252","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:db38fd1108a45a3e87ccb5622feea6376f339233bc3704ebe1f15689d03186d6","observation_id":"44de6843-0d4c-4884-b833-33b6f39c6000","resolution":{"observed_at":"2026-08-15T21:06:21.620099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19553","last_updated":"2024-04-30T13:25:20Z","snapshot_observed_at":"2026-08-16T13:56:36.735039Z","submitted_at":"2024-04-30T13:25:20Z","title":"Extending Llama-3's Context Ten-Fold Overnight","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19553","snapshot_observed_at":"2026-08-15T21:06:21.625023Z","title":"Extending llama-3’s context ten-fold overnight.CoRR, abs/2404.19553, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.625023Z"},"links":{"cited_paper":"/paper/2404.19553","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:80036658c05e582cb062d1ec67f08f2063a8b898ff922d35b6b8a08e140f6f5e","observation_id":"75363c18-7a12-48e7-97fc-8323d8c71b60","resolution":{"observed_at":"2026-08-15T21:06:21.625023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06208","last_updated":"2025-07-17T08:39:11Z","snapshot_observed_at":"2026-08-18T03:37:34.508746Z","submitted_at":"2024-11-09T15:12:43Z","title":"IOPO: Empowering LLMs with Complex Instruction Following via Input-Output Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06208","snapshot_observed_at":"2026-08-15T21:06:21.629057Z","title":"Iopo: Empowering llms with complex instruction following via input-output preference optimization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.629057Z"},"links":{"cited_paper":"/paper/2411.06208","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:76b8f14f160b47963181c07555b67c5c02f194018b7322a098aa7fe5d8e05b7b","observation_id":"23f5ddc1-134a-4958-8589-54d81ba8e1a5","resolution":{"observed_at":"2026-08-15T21:06:21.629057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.633192Z","title":"LONGA- GENT: Achieving question answering for 128k-token-long documents through multi-agent collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.633192Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:63fd96632d24eca32c6b887367311ea322d0482e471aaf308a1b5d4f3c242109","observation_id":"6b168475-3b2c-4c08-9593-503be193790f","resolution":{"observed_at":"2026-08-15T21:06:21.633192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.530764Z","title":null,"venue":null,"work_id":"ed9e8bd0-b2c4-4a29-a5d8-ea76ac3669fe","year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.616025Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:e1c8cae68647d32d4dff831994bfb6db1c110458865e103bd1cbc5948bf7c335","observation_id":"98b2e85e-9240-4041-a61b-dc25b16a9a96","resolution":{"observed_at":"2026-08-15T21:06:22.534771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.641958Z","title":"LlamaFactory: Unified effi- cient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.641958Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:5caeef33509c44f6ec13a91a0374f5134f97452c5335975bc0b1c764cf82b999","observation_id":"817db5e0-9104-480d-8ff4-f2ed4f5e0d81","resolution":{"observed_at":"2026-08-15T21:06:21.641958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-15T21:06:21.646243Z","title":"Instruction-following evaluation for large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.646243Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:bf5e7177a7857c781d66ba18ab8043c5eb963621147012ff741651bb8a90e50f","observation_id":"568bcd0e-55f2-4f65-9c02-a17f075660b8","resolution":{"observed_at":"2026-08-15T21:06:21.646243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.519360Z","title":"PoSE: Efficient con- text window extension of LLMs via positional skip-wise training","venue":null,"work_id":"943b3b82-6016-4cfc-9de8-412a7cd5e5df","year":2024},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.650411Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:3b8d1ead0ef454733cff7aade12464946a8f85ebadf14b7366306b812b2eee19","observation_id":"bf6342b9-9d05-45ab-901d-b49bee060473","resolution":{"observed_at":"2026-08-15T21:06:22.523288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20790","last_updated":"2025-02-28T07:15:12Z","snapshot_observed_at":"2026-08-20T14:11:38.235786Z","submitted_at":"2025-02-28T07:15:12Z","title":"Chain-of-Thought Matters: Improving Long-Context Language Models with Reasoning Path Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20790","snapshot_observed_at":"2026-08-15T21:06:21.653955Z","title":"Chain-of-thought matters: Improving long-context language models with reasoning path supervision.CoRR, abs/2502.20790, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.653955Z"},"links":{"cited_paper":"/paper/2502.20790","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:7a2c5f51e04cbd8ccbbe0c348bc38a16ce0b9d2151f56e0f018317aba24430bf","observation_id":"08d217a7-7671-4793-ac30-d7708bc2385b","resolution":{"observed_at":"2026-08-15T21:06:21.653955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-20T10:41:24.815766Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-08-15T21:06:21.637749Z","title":"Slic-hf: Sequence likelihood calibration with human feedback.arXiv preprint arXiv:2305.10425, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.637749Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:51a1b002c7c0e29ca1d8dacb863c0330e684d96e6e7918104be0542279e913e3","observation_id":"9f678ab7-fc80-4070-93ff-4800f562e6a4","resolution":{"observed_at":"2026-08-15T21:06:21.637749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15592","last_updated":"2025-02-21T17:02:40Z","snapshot_observed_at":"2026-08-16T12:56:17.710364Z","submitted_at":"2025-02-21T17:02:40Z","title":"Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15592","snapshot_observed_at":"2026-08-15T21:06:21.668121Z","title":"Generalizing from short to long: Effective data synthesis for long-context instruction tuning.ArXiv, abs/2502.15592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.668121Z"},"links":{"cited_paper":"/paper/2502.15592","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:6cb1a88f9b80091b9cb75660712f1f9587aa2b4a39c98c096f92dc66dece8d5e","observation_id":"4150fec0-92d4-4e75-aa66-4825d206d802","resolution":{"observed_at":"2026-08-15T21:06:21.668121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15592","last_updated":"2025-02-21T17:02:40Z","snapshot_observed_at":"2026-08-16T12:56:17.710364Z","submitted_at":"2025-02-21T17:02:40Z","title":"Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15592","snapshot_observed_at":"2026-08-15T21:06:21.658781Z","title":"Generalizing from short to long: Effective data synthesis for long-context instruction tuning.CoRR, abs/2502.15592, February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.658781Z"},"links":{"cited_paper":"/paper/2502.15592","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:efcc0789394870ce28eb510e8a1c723934b9f3cc459493ba429acff63991cd76","observation_id":"38dae01b-6055-48ce-8958-1fe75512ae93","resolution":{"observed_at":"2026-08-15T21:06:21.658781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.508911Z","title":null,"venue":null,"work_id":"38215cf8-1a88-4606-a0cc-f39e58f78124","year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.672749Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:6f7a591c28aaf297cd8a599f6936624f0c2894dafa00f0214a434ec8dfd1355d","observation_id":"23949f5e-f084-4d8b-a964-69886c64b526","resolution":{"observed_at":"2026-08-15T21:06:22.512210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6073.3769","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.013577Z","title":"The Collegian","venue":null,"work_id":"59e39833-6475-472c-8dc6-64a58985a083","year":1960},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.676766Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:a0356d628f820bf3ab58b04a3799f2548846a63a384f33f0b77add0cdbd0a6ab","observation_id":"b188141b-00ba-4189-99af-e8a3fb7bd7e4","resolution":{"observed_at":"2026-08-15T21:06:22.019293Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:22.495539Z","title":"In addition, we further examine the theoretical validity of the first motivation from adata-sampling perspective","venue":null,"work_id":"48e0ff03-5c06-4ff0-a60c-2e02c0b4037e","year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.682241Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:6d710576ab00acc6d923db25b3a124aeb335602f8b88da4448f26bb05a87bb52","observation_id":"2b25102c-228a-481c-b64a-cecaef3a30c6","resolution":{"observed_at":"2026-08-15T21:06:22.499465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.304223Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.304223Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:298588e9e0dc1a4ceb349440de9d5055b3252037dcd6b2e1b4a40b6be52479ae","observation_id":"ee0517ce-950d-4a4b-8084-6f15a5b410b5","resolution":{"observed_at":"2026-08-15T21:06:21.304223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.514589Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.514589Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:af8630206d725d31b4deaf65e68898900832e657129a36b89bd4a52e85686623","observation_id":"64d86e4e-55c4-40f4-946d-c82fdcce0c1d","resolution":{"observed_at":"2026-08-15T21:06:21.514589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:06:21.497385Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.497385Z"},"links":{"citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:e500d378919b4dd99ef2c9dadf84ea076e2fd991ece793eb6bc21d539b6ec175","observation_id":"15c472a3-c4d3-4cdb-b69e-181134c4aa87","resolution":{"observed_at":"2026-08-15T21:06:21.497385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12583","last_updated":"2025-05-29T06:01:22Z","snapshot_observed_at":"2026-08-16T12:57:26.813567Z","submitted_at":"2025-02-18T06:40:23Z","title":"LongFaith: Enhancing Long-Context Reasoning in LLMs with Faithful Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12583","snapshot_observed_at":"2026-08-15T21:06:21.595959Z","title":"URLhttps://doi.org/10.48550/arXiv.2502.12583","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:21.595959Z"},"links":{"cited_paper":"/paper/2502.12583","citing_paper":"/paper/2505.11166"},"observation_digest":"sha256:d20546d28b7385b7307bb71ff2f44e0a2f1750e8156bfc0d4a0f0267fcd4ae58","observation_id":"23a3064a-7101-46e7-a0c4-d54932ef993f","resolution":{"observed_at":"2026-08-15T21:06:21.595959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.11166","last_updated":"2026-06-03T04:46:17Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T20:40:16.273856Z","submitted_at":"2025-05-16T12:08:48Z","title":"SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":69,"verified_exact":4,"verified_fuzzy":19},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 1 inbound Pith citation observation for arXiv:2505.11166."}