{"as_of":"2026-08-23T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba0425e5c139fce173af818754b6ec1a3813239af22b39c39ccee5d5ab723d7e","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:53:24.144910Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19996/citation-record","integrity":"/paper/2508.19996/integrity","json":"/paper/2508.19996/citation-record.json","paper":"/paper/2508.19996"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:22.635823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.635823Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:de77dc57385a3d230cb757b872bf62b7f97fd6fc8761a0b6818c760ae81704c1","observation_id":"f10647c8-ed85-49b9-822d-9cef21ffa8da","resolution":{"observed_at":"2026-08-15T16:53:22.635823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T16:53:22.710545Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.710545Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:ba8d7eeaa2bf9f684880d1b7852764309cc27abc040612eaa6901890bd6bd949","observation_id":"03ae6404-01e4-4cdc-bf28-fa0999ac3161","resolution":{"observed_at":"2026-08-15T16:53:22.710545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.539326Z","title":null,"venue":null,"work_id":"36433581-e4a9-492e-a431-c5996fe14532","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.765824Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:ad31ed07a13300fc735efb41c1c51fb61e84340958ba46a18d6f7574d81be05e","observation_id":"82fbd01b-e317-41a7-8819-83582f239710","resolution":{"observed_at":"2026-08-15T16:53:25.578274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-18T08:00:36.453042Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-15T16:53:22.770073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.770073Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:53f3a3cf3c1740d4f6df1107eafba6ea5e6d8f5d37e7de2680893a2562c08768","observation_id":"dfcd6ad6-1880-4786-868f-4f7737c631c8","resolution":{"observed_at":"2026-08-15T16:53:22.770073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-19T15:08:34.393456Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-15T16:53:22.774472Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.774472Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:05e88689479c5bc95ec49bf4a1c39a304ce82e2aee3c12d1a73b51a0e1b46fb2","observation_id":"717c9d84-f083-4143-98c5-1debe8b8c561","resolution":{"observed_at":"2026-08-15T16:53:22.774472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.502054Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":"3a592d2a-221c-4841-abab-0b0b952d055c","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.779149Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:094886d64236740bfb373d8de6163e69a2e3b93059968f949a7558d52295e9a0","observation_id":"0de0604f-ff71-4389-8955-931c12b12fb9","resolution":{"observed_at":"2026-08-15T16:53:25.505964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T16:53:22.783699Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.783699Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:cb9182e96e783569af7667b51d02f09f31ec942f2e1a3c2c96d16bbd28d4f183","observation_id":"38b34c33-d68c-45e9-82d4-fe5acae628c6","resolution":{"observed_at":"2026-08-15T16:53:22.783699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07327","last_updated":"2023-10-31T11:38:07Z","snapshot_observed_at":"2026-08-16T15:40:20.636325Z","submitted_at":"2023-04-14T18:01:29Z","title":"OpenAssistant Conversations -- Democratizing Large Language Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07327","snapshot_observed_at":"2026-08-15T16:53:22.788829Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.788829Z"},"links":{"cited_paper":"/paper/2304.07327","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:06965c241786b277e3769b2bb4ddb92cf76626dfae91c90dae66d6f0cf12ef9d","observation_id":"9772d448-c8aa-46ce-bf8b-4fdd38473acd","resolution":{"observed_at":"2026-08-15T16:53:22.788829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.csl.2015.11.001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.422492Z","title":null,"venue":null,"work_id":"7a0298d1-911b-48c5-a405-9e977f454999","year":2016},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.792835Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:0aebf8a0bb7851fc20c764110fb72e3d1d793a2888c0e391b05b6ab22082ae8a","observation_id":"3f94880b-5269-49cd-bd72-7f66f9009f6e","resolution":{"observed_at":"2026-08-15T16:53:24.426226Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:22.798076Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.798076Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:9166e37ac931455cc7c8cb0658536cadcf24871137938884a750b60239129673","observation_id":"d19cb73e-99c9-457d-8ca2-b2062ac98757","resolution":{"observed_at":"2026-08-15T16:53:22.798076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-18T05:06:04.678949Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-15T16:53:22.802082Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.802082Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:59bd2f6e74df35c4768c373ed0f4eafbf0121a2d1197897d4295511a20e9c637","observation_id":"aa28f2e5-6daf-4799-b1e4-5206150ee31c","resolution":{"observed_at":"2026-08-15T16:53:22.802082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15653","last_updated":"2023-11-27T09:33:13Z","snapshot_observed_at":"2026-08-21T00:25:10.936086Z","submitted_at":"2023-11-27T09:33:13Z","title":"MoDS: Model-oriented Data Selection for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15653","snapshot_observed_at":"2026-08-15T16:53:22.832237Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.832237Z"},"links":{"cited_paper":"/paper/2311.15653","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:eaf53526d6a49e88ef4bea45f981ecd8b7b2a6c8f79af8e47e3628a0575a80ec","observation_id":"e5ff5e40-c2ac-493a-a866-962d67405388","resolution":{"observed_at":"2026-08-15T16:53:22.832237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20231","last_updated":"2025-08-13T03:43:47Z","snapshot_observed_at":"2026-08-19T18:41:11.731630Z","submitted_at":"2025-05-26T17:10:43Z","title":"MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20231","snapshot_observed_at":"2026-08-15T16:53:22.910537Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.910537Z"},"links":{"cited_paper":"/paper/2505.20231","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c8df322373b59bbbe7ee9ccab3353410f498183004cdfdc3351d3bcde5f1ada9","observation_id":"40abd064-255e-4903-9653-d731216da6e8","resolution":{"observed_at":"2026-08-15T16:53:22.910537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-15T16:53:22.970340Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:22.970340Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:fc75162868d97ff5aae4f1d35e8024604564db26a63e973de19a9768a7e6c198","observation_id":"0afdf0da-9178-4431-a175-d9d9be2f19e2","resolution":{"observed_at":"2026-08-15T16:53:22.970340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14387","last_updated":"2024-01-08T04:46:56Z","snapshot_observed_at":"2026-08-21T01:13:54.553878Z","submitted_at":"2023-05-22T17:55:50Z","title":"AlpacaFarm: A Simulation Framework for Methods that Learn from Human Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14387","snapshot_observed_at":"2026-08-15T16:53:23.052812Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.052812Z"},"links":{"cited_paper":"/paper/2305.14387","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:e3f259284778ec01006935539e3ecf620927fb72c62ba6fa7d160475f3ff29ed","observation_id":"0c38aede-0702-451b-8cc9-4c1f8ddd7839","resolution":{"observed_at":"2026-08-15T16:53:23.052812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.484421Z","title":null,"venue":null,"work_id":"9999576b-5148-4ef1-be0f-c766a6e746eb","year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.057382Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:820b057e988f4997cde3f7878ef706dfa85501df8c6cb5fa0992032131f0411c","observation_id":"bb480604-dbb9-4fcb-8da1-30ac210c4959","resolution":{"observed_at":"2026-08-15T16:53:25.487976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-15T16:53:23.060599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.060599Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:38325c03e351f45fbf8475dfa3a02a322c002d210bd9e7a1af7cc640e3b893bf","observation_id":"44fccc91-9124-415c-95c3-bb1a0a3d1e3f","resolution":{"observed_at":"2026-08-15T16:53:23.060599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T16:53:23.064696Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.064696Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:2b2ae931913c009afd3ec01c550bf301694c92df1ad24c0d59ca2efd4a599ff6","observation_id":"3269b9c4-37bd-4a8a-b413-e9ca0d15c67a","resolution":{"observed_at":"2026-08-15T16:53:23.064696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.068957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.068957Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:3def4b4cd30e7d792ad36592b1dcbf3a789f7a8664b5b2cb942a349ccd133401","observation_id":"e4b78710-c398-4964-9155-a58c809f0bcb","resolution":{"observed_at":"2026-08-15T16:53:23.068957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.072942Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.072942Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:09b276d1194907014c99bfa3d551430de1896e8e4c68e4227243e2cade72fcc6","observation_id":"194405ed-a1e4-4235-89d2-65a8f4822b97","resolution":{"observed_at":"2026-08-15T16:53:23.072942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.57967/hf/1428","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.311996Z","title":null,"venue":null,"work_id":"0d6b15e3-d42d-4a25-95db-d8d16eb8ac6f","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.076596Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c9c465fcaa7df650bd462acbbc03c77b747a7af848a2a8c29311b8e4072d56f8","observation_id":"314fbd2b-d2f5-4d77-b493-a7b611928e39","resolution":{"observed_at":"2026-08-15T16:53:24.381560Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-08-16T03:03:21.512563Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-15T16:53:23.080303Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.080303Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:951c35c431821d8797fd1d72209d9fde80cad2e02d0e57aa5211431aad677d0f","observation_id":"913b9e89-8ef7-412b-ab52-9ac7e457651c","resolution":{"observed_at":"2026-08-15T16:53:23.080303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-08-16T13:36:21.119762Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-15T16:53:23.084505Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.084505Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:3740f349fdc864e7d665e2f48f37edbc3e6ef3d7d19b1d1b1e904366b45d83fa","observation_id":"a06f190c-8419-4e18-a2b3-85bf9ca56358","resolution":{"observed_at":"2026-08-15T16:53:23.084505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T16:53:23.088432Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.088432Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:fa65923ecc2844e74f2745b3423b7ef1a81e8fd8eaddf425ecc8f43616b8eace","observation_id":"5755cbde-4e52-4b45-a840-cfda9b32aa87","resolution":{"observed_at":"2026-08-15T16:53:23.088432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.092553Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.092553Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:fa3a744ecf41d0a114114efec9cf3dfaed6c06f517bb515dbd87c31ec5363848","observation_id":"ab59eb2b-e59c-4285-ab43-ea66a02793c9","resolution":{"observed_at":"2026-08-15T16:53:23.092553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.129228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.129228Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:4e8187e5672da1ab37b4d9b600000cc991e9c7d3c6224a173aebef3ac54dd88f","observation_id":"7c18b68d-87a2-4fa0-a04c-3b77c4710a63","resolution":{"observed_at":"2026-08-15T16:53:23.129228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.219890Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.219890Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:7727e8b063ad5830a48772d0133e7d81d1f86b94141ebd276aee4ccc9dec4e55","observation_id":"a6186450-f037-47de-8ade-d2fcd2d2eaab","resolution":{"observed_at":"2026-08-15T16:53:23.219890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16745","last_updated":"2024-01-30T04:50:28Z","snapshot_observed_at":"2026-08-16T14:23:23.248848Z","submitted_at":"2024-01-30T04:50:28Z","title":"MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16745","snapshot_observed_at":"2026-08-15T16:53:23.265499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.265499Z"},"links":{"cited_paper":"/paper/2401.16745","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:7ea2108782882978e648d2a58e26b67123375fdc65a9bea3ca6a1a29ae1b8f88","observation_id":"4950a1a8-6d54-4e7b-9100-741d92b2e643","resolution":{"observed_at":"2026-08-15T16:53:23.265499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.323519Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.323519Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:3f70ed5bbf22c63e8fac0e6e1d0f605947cb59ab46b6b8dd9a1bae028318d8fd","observation_id":"a08f90e0-8ed3-4f38-a95e-ae99c3c68de5","resolution":{"observed_at":"2026-08-15T16:53:23.323519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.465646Z","title":null,"venue":null,"work_id":"8325f5e6-6156-4848-82ed-af5e60a56af7","year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.382869Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c7be2c2e9d1e7b3274529310c621c69633bdeccf870560ccb53c99b62d9c7912","observation_id":"17c6750a-035b-45f7-b154-8c4ec800a170","resolution":{"observed_at":"2026-08-15T16:53:25.469471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.385896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.385896Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c8b49e500febd6468d585dfeeb89e5509eae0783b73e4d28d5682bbec57b26b0","observation_id":"43a1d1f9-2888-4196-b3cc-d7e316d0709e","resolution":{"observed_at":"2026-08-15T16:53:23.385896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06259","last_updated":"2024-03-12T05:22:46Z","snapshot_observed_at":"2026-08-16T15:09:03.366337Z","submitted_at":"2023-08-11T17:47:54Z","title":"Self-Alignment with Instruction Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06259","snapshot_observed_at":"2026-08-15T16:53:23.389292Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.389292Z"},"links":{"cited_paper":"/paper/2308.06259","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:8e6f7a9bf8b3786f3212520dda227cd779cde8b2fa70c9378e0c67576358f947","observation_id":"70a761f2-bd8f-42e2-9035-b4f9c71549fb","resolution":{"observed_at":"2026-08-15T16:53:23.389292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.392910Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.392910Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:14a6a0853cec0200f8b839e5a785f3eb5d122e37a121858a8fc0da7f4a83c0f6","observation_id":"40ed8e6d-d6ac-4220-8eba-de53b7dea1b0","resolution":{"observed_at":"2026-08-15T16:53:23.392910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.252","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.279916Z","title":null,"venue":null,"work_id":"ffb18511-7311-4ddf-a547-3a22bfd2fe6c","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.397011Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:10286742f85b1be546b432d97a255f9bfa6e8963c0e4d0f176f1acb3fcd5b2b7","observation_id":"51d21797-22bc-46ad-8d91-67bb62f49797","resolution":{"observed_at":"2026-08-15T16:53:24.285040Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-15T16:53:23.400392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.400392Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:0fd0fce76f1aba86d3a7269302b8679d86cd64603cfcdea0c6947de0b52ec8fe","observation_id":"55713bee-64ea-44aa-ac65-22c47f218f2a","resolution":{"observed_at":"2026-08-15T16:53:23.400392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.444635Z","title":null,"venue":null,"work_id":"1f909719-7592-4471-a8d9-7c3ae06fca44","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.446430Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:4cbc8a9a412a7007788289175124b4708fa912226b6ba92a7360b1b8c1ecbb6c","observation_id":"18611a9a-fbff-4cd9-960e-cbd4a4518022","resolution":{"observed_at":"2026-08-15T16:53:25.448786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.491011Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.491011Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:6a233d94aed3a44197f0dc82c18dacc8cfeb2542a930541e1955345ffc1aa471","observation_id":"cde69e0a-c294-45f6-b4e6-a5554a23a5b6","resolution":{"observed_at":"2026-08-15T16:53:23.491011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08239","last_updated":"2023-08-23T03:37:04Z","snapshot_observed_at":"2026-08-16T15:08:09.483891Z","submitted_at":"2023-08-16T09:15:18Z","title":"MemoChat: Tuning LLMs to Use Memos for Consistent Long-Range Open-Domain Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08239","snapshot_observed_at":"2026-08-15T16:53:23.515745Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.515745Z"},"links":{"cited_paper":"/paper/2308.08239","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:89a4e625762d700cd60a38e133063caecccdace288c5db33b064a0bf49eb1a4b","observation_id":"6340960d-80d7-4ecb-abb4-1f0bf2627fe7","resolution":{"observed_at":"2026-08-15T16:53:23.515745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07074","last_updated":"2023-08-15T07:37:32Z","snapshot_observed_at":"2026-08-16T22:33:06.082574Z","submitted_at":"2023-08-14T11:16:28Z","title":"#InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07074","snapshot_observed_at":"2026-08-15T16:53:23.519301Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.519301Z"},"links":{"cited_paper":"/paper/2308.07074","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:912d113c35ccd25412b1d0833258d8b2c2d6c398fe5bad4a9eba68ac0139ecc2","observation_id":"1a5ebd7a-4569-4943-b910-d0f511449864","resolution":{"observed_at":"2026-08-15T16:53:23.519301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16783","last_updated":"2025-03-04T07:56:00Z","snapshot_observed_at":"2026-08-17T02:37:33.943124Z","submitted_at":"2024-06-24T16:45:13Z","title":"M2Lingual: Enhancing Multilingual, Multi-Turn Instruction Alignment in Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.16783","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16783","snapshot_observed_at":"2026-08-15T16:53:24.738176Z","title":"M2Lingual: Enhancing Multilingual, Multi-Turn Instruction Alignment in Large Language Models","venue":"cs.CL","work_id":"cf06d60f-768c-4ecb-80d9-5850ff2b58c4","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.523157Z"},"links":{"cited_paper":"/paper/2406.16783","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f946380a0630dd370e111279da2df25c317df5bd9c63c672a0d31220362ed6e6","observation_id":"156ec57c-cb0c-4460-8965-c9480714e939","resolution":{"observed_at":"2026-08-15T16:53:24.742626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-18T15:17:25.814187Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-15T16:53:23.526966Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.526966Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:0a5668bb245b0754d1297a8bc266c7b34210863bc0a2c169074195490d6931ee","observation_id":"2d18eea2-2a4a-4ef9-931d-23ee358c11c6","resolution":{"observed_at":"2026-08-15T16:53:23.526966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.391114Z","title":null,"venue":null,"work_id":"ba4e6786-a805-4413-9b23-28c82289c411","year":2021},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.531323Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:b5f238de3617c0c60eb2f81252791038e34e57aa18b9a64dbf0fe7c459b61370","observation_id":"faebdb45-7e5a-48c2-b23e-893817dcfe90","resolution":{"observed_at":"2026-08-15T16:53:25.435919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T16:53:23.534986Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.534986Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:211db87f06683efe90fd5623f12e77e72ee337c7ff24945d1576a43c7046a097","observation_id":"a78009d9-526a-4a44-9a37-763a36d2a6d2","resolution":{"observed_at":"2026-08-15T16:53:23.534986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.282528Z","title":null,"venue":null,"work_id":"b2c73d80-eb9b-4f90-866a-f1be7b09066d","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.538893Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:863c53d5beb8fadfd5ad8ca80a3fe9e483a21408b9dedd35df99a256036326ab","observation_id":"b50cab77-a832-459c-a22a-f6b6890bf261","resolution":{"observed_at":"2026-08-15T16:53:25.331798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.541858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.541858Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:0d12ee853b4f02c96c455bd86c2ca06f33bba42e8d305f712fd8db3d00014159","observation_id":"ed2ff7a4-8dc7-4b8c-bef3-32e57142fef8","resolution":{"observed_at":"2026-08-15T16:53:23.541858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04579","last_updated":"2017-04-15T04:47:25Z","snapshot_observed_at":"2026-08-19T09:10:10.435525Z","submitted_at":"2017-04-15T04:47:25Z","title":"Evaluating Quality of Chatbots and Intelligent Conversational Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04579","snapshot_observed_at":"2026-08-15T16:53:23.544795Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.544795Z"},"links":{"cited_paper":"/paper/1704.04579","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:9047c4d69e906c9dce71b03b045406f395f4a6e628681c3486421be48f053023","observation_id":"8a3b728e-5fe5-428a-ac67-8e466dc45789","resolution":{"observed_at":"2026-08-15T16:53:23.544795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.272200Z","title":null,"venue":null,"work_id":"95ffd020-3bfc-4292-b99d-1c08a394a016","year":2018},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.548603Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:6b02819df80b5bfeda083b67ecec726dfae5e0eea45d0e906c091fd193e9e0b0","observation_id":"e78b44c6-b917-46ff-a038-fc3f395e2e1d","resolution":{"observed_at":"2026-08-15T16:53:25.275143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.261872Z","title":null,"venue":null,"work_id":"6a225d13-c57e-4da9-b24a-944a16bf5e61","year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.612899Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:35948e21242f31a11340286f6d753d7957766edad007d7ceff50d5ede1660e33","observation_id":"f68002ae-1fd1-4dbe-abc6-9136f77189b1","resolution":{"observed_at":"2026-08-15T16:53:25.265239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14655","last_updated":"2024-12-02T12:37:46Z","snapshot_observed_at":"2026-08-17T05:06:22.790424Z","submitted_at":"2024-05-23T14:53:54Z","title":"Multi-turn Reinforcement Learning from Preference Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14655","snapshot_observed_at":"2026-08-15T16:53:23.703827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.703827Z"},"links":{"cited_paper":"/paper/2405.14655","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:d9e5e6f49ca7273864e51495ebeaedf2d6f4bb3cbea3b40a92235aebf944d32c","observation_id":"edbffcce-2a21-4322-abf6-f1115ea510ba","resolution":{"observed_at":"2026-08-15T16:53:23.703827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06619","last_updated":"2024-02-09T18:51:49Z","snapshot_observed_at":"2026-08-19T11:27:21.408581Z","submitted_at":"2024-02-09T18:51:49Z","title":"Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06619","snapshot_observed_at":"2026-08-15T16:53:23.707591Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.707591Z"},"links":{"cited_paper":"/paper/2402.06619","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:003b2e5174db0c68311cad347af21eeda4b04466801edc4d3ee573ad95cff0f0","observation_id":"ad3238a6-8f2b-44ad-a7cc-4ee27f4e979e","resolution":{"observed_at":"2026-08-15T16:53:23.707591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.250900Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":"996782bb-9026-4b89-bd38-e3298d68e5d6","year":2020},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.713111Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:47edf3ae914f0bd4a61edbf13729a5abb3368c9feb8cb6f34f5c01b452002def","observation_id":"37623523-3b5d-4487-a2c0-ccab6b8783d6","resolution":{"observed_at":"2026-08-15T16:53:25.254556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.717175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.717175Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:f31b7a6daa50c28189419029b77b56c1899bb6da4e70b07219f63760c2216ada","observation_id":"79ca3aab-10f8-4ea0-935a-c8fbb2c996d8","resolution":{"observed_at":"2026-08-15T16:53:23.717175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.720845Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.720845Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:2a8d37fe7155028944428a1f8c007a797c578f135a02fd6334bd66ad45fa82e4","observation_id":"88715478-c663-4b37-bbec-fccf5eb0d830","resolution":{"observed_at":"2026-08-15T16:53:23.720845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T16:53:23.724594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.724594Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:451fca45de167a63ef9f7b2804ec91f0e8ef6d268e333045937dcb934b643a5e","observation_id":"3f7944d5-7ad1-4201-8108-bf8422d1f19e","resolution":{"observed_at":"2026-08-15T16:53:23.724594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-16T14:21:42.526503Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-15T16:53:23.728202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.728202Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:681fc0739905d49924a07fe7a4ab7de9614b3fabf90bf525f9e44a35657bea7e","observation_id":"6cadf8f1-2ae0-412f-b6a6-8d73e5b1b716","resolution":{"observed_at":"2026-08-15T16:53:23.728202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.780407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.780407Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:04d6e56515340071c65136d1a6693e3e97db51defb3ca5dff131c76edde1fbaa","observation_id":"9c32b1ec-7aa1-4914-8948-228fbb7abd4a","resolution":{"observed_at":"2026-08-15T16:53:23.780407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10646","last_updated":"2024-06-17T16:39:02Z","snapshot_observed_at":"2026-08-16T14:18:00.404566Z","submitted_at":"2024-02-16T12:47:11Z","title":"AbsInstruct: Eliciting Abstraction Ability from LLMs through Explanation Tuning with Plausibility Estimation","version":2},"cited_work":{"arxiv_id":"2402.10646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10646","snapshot_observed_at":"2026-08-15T16:53:24.623129Z","title":"AbsInstruct: Eliciting Abstraction Ability from LLMs through Explanation Tuning with Plausibility Estimation","venue":"cs.CL","work_id":"0f0dfbeb-250e-44f6-8b82-ad16a7267cf7","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.866631Z"},"links":{"cited_paper":"/paper/2402.10646","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:13b01731dbbb953de10e9ca4786692071445c496a61bdbc851842e3947a7e932","observation_id":"425bb46b-fdd3-40c7-9b8d-5739ebae06c4","resolution":{"observed_at":"2026-08-15T16:53:24.658131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12067","last_updated":"2026-04-12T14:13:44Z","snapshot_observed_at":"2026-08-17T11:42:02.077158Z","submitted_at":"2023-08-23T11:27:30Z","title":"MM-LIMA: Less Is More for Alignment in Multi-Modal Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12067","snapshot_observed_at":"2026-08-15T16:53:23.871102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.871102Z"},"links":{"cited_paper":"/paper/2308.12067","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:4b20799b114c991479ac16ec4273f7417b6b21bf8b7a3bf93f930a5feff2c00e","observation_id":"bd1340cb-97d1-4b6e-bc8f-8c54e56c9c3e","resolution":{"observed_at":"2026-08-15T16:53:23.871102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.198437Z","title":null,"venue":null,"work_id":"91fb37b8-1294-4499-bc84-15265dc3838b","year":1962},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.875904Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:e566f8a9feaaed1da8b4da26e919b3f3a13a3debdac903975d24d4ce2b1cb465","observation_id":"30f9a656-305a-4232-83a7-fa56aadc9667","resolution":{"observed_at":"2026-08-15T16:53:25.237307Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12024","last_updated":"2022-03-23T12:13:07Z","snapshot_observed_at":"2026-08-18T18:51:15.078201Z","submitted_at":"2022-02-24T11:08:02Z","title":"NoisyTune: A Little Noise Can Help You Finetune Pretrained Language Models Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12024","snapshot_observed_at":"2026-08-15T16:53:23.879033Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.879033Z"},"links":{"cited_paper":"/paper/2202.12024","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:d40e036d329c1190d111e349876bc2d278e26896d2ecf566d7021eb2d34a93f5","observation_id":"5fd3280d-10e0-433e-9dcd-66cf22252cab","resolution":{"observed_at":"2026-08-15T16:53:23.879033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.882997Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.882997Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:2797dce960032dab2617ea5173ad68fa1661bfa731bb6292112cafb5af8a27c9","observation_id":"872e8747-ade3-4f00-90ad-4b0325b85acf","resolution":{"observed_at":"2026-08-15T16:53:23.882997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08182","last_updated":"2023-11-14T14:10:40Z","snapshot_observed_at":"2026-08-18T16:03:21.486762Z","submitted_at":"2023-11-14T14:10:40Z","title":"Self-Evolved Diverse Data Sampling for Efficient Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08182","snapshot_observed_at":"2026-08-15T16:53:23.892270Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.892270Z"},"links":{"cited_paper":"/paper/2311.08182","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:7e128b1ed9dabc58557160bbe979b11c241693be658404a220d626454e8371f2","observation_id":"14e13088-dd88-4c53-930c-065cc08b1a20","resolution":{"observed_at":"2026-08-15T16:53:23.892270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:23.896087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.896087Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:27bb926f2e4da27fd9764dd9703308df9945cafebc20274f36f365562ee758dc","observation_id":"a55ba2e6-5896-4da2-86ab-3274ef4cccd2","resolution":{"observed_at":"2026-08-15T16:53:23.896087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11508","last_updated":"2023-12-27T08:23:14Z","snapshot_observed_at":"2026-08-16T22:21:23.594077Z","submitted_at":"2023-12-12T03:30:21Z","title":"Rethinking the Instruction Quality: LIFT is What You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11508","snapshot_observed_at":"2026-08-15T16:53:23.926453Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:23.926453Z"},"links":{"cited_paper":"/paper/2312.11508","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:1ee86c437d8f84549de447e88f21618d4486342f46f6abdea1d6ea43333a7ea5","observation_id":"af67aada-dfe9-4b87-8a61-8ba7da4a36f7","resolution":{"observed_at":"2026-08-15T16:53:23.926453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-16T14:14:41.393057Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-15T16:53:24.015703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.015703Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:0ec3129e027481ccce392c5ddaa51b021a2f2177bbcebae34273ce8b533bd512","observation_id":"ed9c2741-f0de-4de8-b376-7a02339b05d9","resolution":{"observed_at":"2026-08-15T16:53:24.015703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.034998Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.034998Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:da87b7af4407278946363d1601606276eb1319f21e1a0d47e3b65b0626f9fa02","observation_id":"4688c757-0177-4528-9859-2c83033845bc","resolution":{"observed_at":"2026-08-15T16:53:24.034998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.039546Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.039546Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:0632b1a8757edbfa79b85305075878c494facadbaef464f4d9c932b06206ca8f","observation_id":"8fede186-0f16-46d8-b3eb-bb6ea6e76840","resolution":{"observed_at":"2026-08-15T16:53:24.039546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.042659Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.042659Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:9e33fec13a06a1e3067b74c22c7faa9cebbe2daeea0896d043175f2105f8919b","observation_id":"696361dc-556d-42ee-85c3-da78279a9671","resolution":{"observed_at":"2026-08-15T16:53:24.042659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.112042Z","title":null,"venue":null,"work_id":"6c6727e8-e603-4aee-93b0-c23b8ed01347","year":2020},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.046352Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:c4040152b18bdbaa9983d911aece648139b09025fe57cd241d1be41ffb3b67f8","observation_id":"8c24506c-dd7e-481d-8394-c3e214f02e01","resolution":{"observed_at":"2026-08-15T16:53:25.126994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-08-20T02:45:07.091553Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03507","snapshot_observed_at":"2026-08-15T16:53:24.049490Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.049490Z"},"links":{"cited_paper":"/paper/2403.03507","citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:ffb84e31ff1d7af189db60016b0722fe65b0d892b871322d274c5f03f7a9d44b","observation_id":"f03a0931-03e7-4063-ae9b-641bcf4cf1f3","resolution":{"observed_at":"2026-08-15T16:53:24.049490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:25.100805Z","title":null,"venue":null,"work_id":"d4baa9b4-0c9d-4656-a1f1-d203e8753335","year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.053224Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:053e7c3657c7392d01f2dbdcb0822e84dfedde8e7849e2b0e7c1e3cbbccb68b1","observation_id":"ce54a194-d112-4fe9-9bc9-fc77485275cd","resolution":{"observed_at":"2026-08-15T16:53:25.104662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.057189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.057189Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:5675904aa7169a0561391c57b84204857f335ec784a2806a3c0b22d5e48d287e","observation_id":"fbb7a8df-1644-4e7d-a778-05e9e2990d62","resolution":{"observed_at":"2026-08-15T16:53:24.057189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.060676Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.060676Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:8451c9b123478793660410f1b419c7d6cea198e2243a0b0721e226a3ba61aee8","observation_id":"3077031c-8295-4a42-b6eb-cab432af6f20","resolution":{"observed_at":"2026-08-15T16:53:24.060676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.064794Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.064794Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:720847e6542721886d2a9198aa1eb171cc26c12505d35610200fc8cf96a4ac6d","observation_id":"ef8982e5-a11d-4dd9-8bdc-0e7582c7f687","resolution":{"observed_at":"2026-08-15T16:53:24.064794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:53:24.144910Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T16:53:24.144910Z"},"links":{"citing_paper":"/paper/2508.19996"},"observation_digest":"sha256:e377d85a166edf4432a0c19fc2436038f66a7f5824476c1b21d95428ac46daba","observation_id":"57553d04-06d2-4684-b091-326437b04518","resolution":{"observed_at":"2026-08-15T16:53:24.144910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19996","last_updated":"2025-08-27T15:54:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T17:36:46.544726Z","submitted_at":"2025-08-27T15:54:01Z","title":"ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":68,"verified_exact":5,"verified_fuzzy":2},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2508.19996."}