{"as_of":"2026-08-15T23:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e5b43772d0749ef1b8b4486ac56380ff0f1c09b289c2b0fe4e0bc58342db632","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:56:40.844714Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.07884/citation-record","integrity":"/paper/2510.07884/integrity","json":"/paper/2510.07884/citation-record.json","paper":"/paper/2510.07884"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-08-14T16:23:27.194766Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-08-04T10:56:35.942089Z","title":"Mathqa: Towards interpretable math word problem solving with operation-based formalisms","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:35.942089Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:6b42571e9911d1be8ef5b7d9781f52631a3178d77d750267781a7ae2f014d9df","observation_id":"b0d32023-c3bd-447e-b6cb-ae06513c6815","resolution":{"observed_at":"2026-08-04T10:56:35.942089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-04T10:56:36.020206Z","title":"Brown, Jack Clark, Sam McCandlish, Chris Olah, and Jared Kaplan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.020206Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:c6dab208fb2fe66180027ef0c218f30f09d0939173534a529b2daf7ceb2284e9","observation_id":"137215f9-6c5f-4dd6-a1d9-150e46164c14","resolution":{"observed_at":"2026-08-04T10:56:36.020206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.075904Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.075904Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:b2d468ae933468d3d44b70de842f95e3a307830f9f16dc82f244ffe16655c080","observation_id":"ebc5bec7-4de1-4165-ade1-213b495b916e","resolution":{"observed_at":"2026-08-04T10:56:36.075904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.155865Z","title":"Weak-to-strong generalization: Eliciting strong capabilities with weak supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.155865Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:2d5bff6baf5ea03abff7fc116ed550b3d0087e67d3c217b9ce7050bb27666ba7","observation_id":"8f65b2e0-0934-4947-85f0-8d4be91fb90c","resolution":{"observed_at":"2026-08-04T10:56:36.155865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.216263Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.216263Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:9c3a5af95316306d2f413c065c6bc5ece5a72bde5977aade5fdf1f580a2288f5","observation_id":"c2108adf-6aec-41b6-a562-6136b1153a19","resolution":{"observed_at":"2026-08-04T10:56:36.216263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.298997Z","title":"Glass, and Pengcheng He","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.298997Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:f2a2bbdb61b6793fdf84516cfae748adbe0460289483e0da9b55b6ea85df7b1f","observation_id":"222f5780-28ae-4f2b-ad85-aa77019220b4","resolution":{"observed_at":"2026-08-04T10:56:36.298997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-04T10:56:36.352868Z","title":"Think you have solved question answering? try arc, the AI2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.352868Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:a6bcd57329f8e79378a198802ad0f911f9da9ac92c531c9cbd8d59515656a4dc","observation_id":"5b06728d-ddae-4809-b09c-001d18937a55","resolution":{"observed_at":"2026-08-04T10:56:36.352868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-04T10:56:36.416809Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.416809Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:a3a1a7102eb05fd0a7a8a09366c7d8a6c46238752e2fc75e984edd6d4ae14f8a","observation_id":"64d66d1d-f8e5-4522-b728-7f24d2c4f2df","resolution":{"observed_at":"2026-08-04T10:56:36.416809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.460106Z","title":"ULTRAFEEDBACK: boosting language models with scaled AI feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.460106Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:bf639d8f358ad4481a426b5da9acec36d77f6add19109a66001892be120dc389","observation_id":"25faaa4e-54c0-4856-aef4-dd609874f25c","resolution":{"observed_at":"2026-08-04T10:56:36.460106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-04T10:56:36.521543Z","title":"Process reinforcement through implicit rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.521543Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:71839b9f89e7dbb28747fdb641a8cdf9d1ebe2776f24ac4a863878999da3e1a4","observation_id":"464efe5a-f56b-4253-b89d-bceb7ca8be1b","resolution":{"observed_at":"2026-08-04T10:56:36.521543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T10:56:36.565292Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.565292Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:a370719150accc1ab9e5fcaba0c62fd582fe2b7737b1d4fae0d8b25f0f23abe9","observation_id":"c90f6ead-2433-4d9e-a3c8-a4cba3a8a934","resolution":{"observed_at":"2026-08-04T10:56:36.565292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-04T10:56:36.656752Z","title":"Hashimoto","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.656752Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:98e1ccc98aa23aa67d7bd0afedbb7e3002109a009fad77875f1860d1d8dd54fd","observation_id":"1eda65ab-faf1-49d5-94c6-c370c8350817","resolution":{"observed_at":"2026-08-04T10:56:36.656752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.699319Z","title":"Artificial general intelligence: Concept, state of the art, and future prospects","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.699319Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:618a2d5c099208d7dbfa28aace8fb52c9f442c48b79d479bb7080792bed9ea63","observation_id":"e38380c1-e2d8-433c-87a3-0735dac66086","resolution":{"observed_at":"2026-08-04T10:56:36.699319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.761532Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.761532Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:cd68065b25d67a336107004ed097781de22adf28db133a7305ad2f12246073bc","observation_id":"2d0f0978-c980-4d6a-96c5-3878d02baace","resolution":{"observed_at":"2026-08-04T10:56:36.761532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:36.815932Z","title":"ORPO: monolithic preference optimization without reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.815932Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:7c75368f0783b22220d9b595e44140cae69428b08ff603fae8add7d89b215cfa","observation_id":"70c9cd82-666c-4b46-baa6-cf060e9a7184","resolution":{"observed_at":"2026-08-04T10:56:36.815932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19852","last_updated":"2025-04-04T11:14:49Z","snapshot_observed_at":"2026-08-05T20:02:35.087707Z","submitted_at":"2023-10-30T15:52:15Z","title":"AI Alignment: A Comprehensive Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19852","snapshot_observed_at":"2026-08-04T10:56:36.895128Z","title":"AI alignment: A comprehensive survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.895128Z"},"links":{"cited_paper":"/paper/2310.19852","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:89989b4e6556c76e690f6abf89f1cb06e47ef44bd6113732a2a045b2864ee8ac","observation_id":"f3aebe1a-a527-4b0c-b02f-e70e20b6a78b","resolution":{"observed_at":"2026-08-04T10:56:36.895128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16468","last_updated":"2026-06-17T06:47:51Z","snapshot_observed_at":"2026-08-13T17:36:53.605634Z","submitted_at":"2024-12-21T03:51:04Z","title":"The Road to Artificial SuperIntelligence: A Comprehensive Survey of Superalignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16468","snapshot_observed_at":"2026-08-04T10:56:36.974772Z","title":"The road to artificial superintelligence: A comprehensive survey of superalignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:36.974772Z"},"links":{"cited_paper":"/paper/2412.16468","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:c327007924ff969611d48c0a3c7b6a02c97bca24f85d77be1d0002abb13caf95","observation_id":"6779d713-240a-4602-8131-0018306eae3e","resolution":{"observed_at":"2026-08-04T10:56:36.974772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.034365Z","title":"RLAIF vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.034365Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:08bb49de36c4bf3ba0d9e258e95d5beced3541697d8f7edbebbe1e367297ce6b","observation_id":"5ef137cd-12a6-4ccc-8984-dd172af87b0c","resolution":{"observed_at":"2026-08-04T10:56:37.034365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-08-15T21:31:17.600844Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-04T10:56:37.116353Z","title":"Scalable agent alignment via reward modeling: a research direction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.116353Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:e7406a097f08eb63cb77f09ac8dcd9f5a7d2f38499372fe1e0e449a6f25e2c65","observation_id":"57594bd1-0c0c-4f0a-9891-1937d44e3e1c","resolution":{"observed_at":"2026-08-04T10:56:37.116353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-11T09:34:38.920981Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-04T10:56:37.225419Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.225419Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:d0f37790dfd525ea0b998c4b1a3d22b7dac5c4b8c00044573bb1707cc6ac9764","observation_id":"54fdf2cd-095e-4648-8f58-8eb2e51a44ed","resolution":{"observed_at":"2026-08-04T10:56:37.225419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.302180Z","title":"Contrastive decoding: Open-ended text generation as optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.302180Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:4d00aa17a1062f00432b5bb63a266c78a2941b9f91a103b59951442feaf420c4","observation_id":"f7f05201-f978-4c64-ba0a-fbbfdbb93e9c","resolution":{"observed_at":"2026-08-04T10:56:37.302180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.377675Z","title":"Strong empowered and aligned weak mastered annotation for weak-to-strong generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.377675Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:08b4de35a8a3e4214f2c0b3ec30553a187637021e4209f4349883ab6e47429e8","observation_id":"ea3b51f2-d902-49bc-a250-38947680cd83","resolution":{"observed_at":"2026-08-04T10:56:37.377675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.451537Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.451537Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:c2233a38bcae8f067d3c188504962a6bee159f46f8c76186bd81e84fd6fa3bed","observation_id":"34d373b1-5442-4e1b-a924-255a09f88365","resolution":{"observed_at":"2026-08-04T10:56:37.451537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.506239Z","title":"MACPO: weak-to-strong alignment via multi-agent contrastive preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.506239Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:399126453dde47787545830301940e41adac90581e529b1762b5318c277d57e0","observation_id":"963a2b5d-d1d2-4909-b684-32a08fd4e36d","resolution":{"observed_at":"2026-08-04T10:56:37.506239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.579144Z","title":"Simpo: Simple preference optimization with a reference-free reward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.579144Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:53fe3a07eccb49c6f9087a9809181ae5c2fcba9e842500db5f3e53eecb0b4cf1","observation_id":"8d101127-054d-436e-ac3b-32e1e75b327a","resolution":{"observed_at":"2026-08-04T10:56:37.579144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.659284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.659284Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:564e988bf0f774b7264adcdcd619ef06a2dac7870cf439ff63da5606322dadbd","observation_id":"c0f52ddf-8b96-43da-b42a-b6f68e191ae2","resolution":{"observed_at":"2026-08-04T10:56:37.659284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T10:56:37.815475Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.815475Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:c08e06129aee98bfa796dd1f2b2b260b014a7525c8f50296345eb03428fa5c38","observation_id":"360e3fee-25da-4a5f-b656-3077c6cc3cd4","resolution":{"observed_at":"2026-08-04T10:56:37.815475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:37.936275Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:37.936275Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:2a67ee1620ec3067888fa58a81cdb8baa521f2069f7730a768777b07fbbf2d4b","observation_id":"be834da6-4e7b-43dc-9bbe-a1ead39b9867","resolution":{"observed_at":"2026-08-04T10:56:37.936275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:38.068628Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.068628Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:94123214504048955a7689b0f3adb2bc23dcc6aa21acd20d75661c460c51dc94","observation_id":"6dac21e1-6ba1-4cd1-9b33-1d492b6ef1bb","resolution":{"observed_at":"2026-08-04T10:56:38.068628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T10:56:38.134964Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.134964Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:08b43bf7d4d54dfcd2898075c894a516e5c1ff49bdc0741e204c62a2acf32647","observation_id":"60dca906-7e0c-4ea0-8da8-139c89a4b591","resolution":{"observed_at":"2026-08-04T10:56:38.134964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-08-13T10:04:36.296007Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-04T10:56:38.235961Z","title":"Large language model alignment: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.235961Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:921c661285f3356b648fe9f4c21bd5ac4e56e325cf69e8c982a7050c21470a13","observation_id":"7df6a7ba-5ed1-4aae-a0bd-bf7125bf88f9","resolution":{"observed_at":"2026-08-04T10:56:38.235961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:38.367594Z","title":"A transfer learning framework for weak to strong generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.367594Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:1b450212ab4dcd0ece65af8563deb1404647336dee911b2d189041af48271789","observation_id":"30ef333d-eb7d-41fe-8eaf-38c6420a11ff","resolution":{"observed_at":"2026-08-04T10:56:38.367594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:38.441094Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul F","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.441094Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:6c50010ef2544e1b0444ca7d5a3049acb3f73e854afb673ec6a2a2a508c70e6b","observation_id":"e5cbe709-d382-4368-aa4a-73c955ed2747","resolution":{"observed_at":"2026-08-04T10:56:38.441094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:38.557406Z","title":"Eleutherai/lm-evaluation-harness: v0.4.3, July 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.557406Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:ffe7280a1ec375dc33ef152e6a6776aefecac5c022d7203e9b78c0fb06e068f0","observation_id":"7e176b35-60fd-44d7-bed4-4d9e42d77939","resolution":{"observed_at":"2026-08-04T10:56:38.557406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:38.710757Z","title":"Interpretable preferences via multi-objective reward modeling and mixture-of-experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.710757Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:a7658a34db296351b13eed9096113689726dbb758d6df95bce6a65e2fd83862e","observation_id":"525ae0b0-668f-4ecf-96ab-68ca928490f8","resolution":{"observed_at":"2026-08-04T10:56:38.710757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-04T10:56:38.894509Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:38.894509Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:25e6e0636418a4ed823c22c7aad002c885e728408baf0627eace3ec171698507","observation_id":"90aba70e-51f0-4d8a-9cf8-6aaaa24c599b","resolution":{"observed_at":"2026-08-04T10:56:38.894509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:39.109506Z","title":"Super(ficial)-alignment: Strong models may deceive weak models in weak-to-strong generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.109506Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:e4d1d2db93233b0757a7ec6cbc9667a2c1be705375faa17deea6c09a62550cd0","observation_id":"22f4f29c-b901-4429-aa86-fca712088d66","resolution":{"observed_at":"2026-08-04T10:56:39.109506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01458","last_updated":"2025-06-04T01:52:51Z","snapshot_observed_at":"2026-08-13T17:37:41.973884Z","submitted_at":"2025-02-03T15:48:28Z","title":"The Capabilities and Limitations of Weak-to-Strong Generalization: Generalization and Calibration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01458","snapshot_observed_at":"2026-08-04T10:56:39.233816Z","title":"Understanding the capabilities and limitations of weak-to-strong generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.233816Z"},"links":{"cited_paper":"/paper/2502.01458","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:eb1b04119d0f234da9d265c8c5c58559fe5c7913a6e4540eba301e8f4c9d5915","observation_id":"0363d6e7-5c30-4ef6-8a20-7898b4a4b454","resolution":{"observed_at":"2026-08-04T10:56:39.233816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01981","last_updated":"2024-12-02T21:20:02Z","snapshot_observed_at":"2026-08-11T23:55:34.185936Z","submitted_at":"2024-12-02T21:20:02Z","title":"Free Process Rewards without Process Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01981","snapshot_observed_at":"2026-08-04T10:56:39.305067Z","title":"Free process rewards without process labels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.305067Z"},"links":{"cited_paper":"/paper/2412.01981","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:f7de0f4c8e3ac9c489f32d4d65d8ab02dca42fdcb17e949016ac47077fc8707c","observation_id":"ce83bb69-ef87-45a4-a8f0-7df4b84074be","resolution":{"observed_at":"2026-08-04T10:56:39.305067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:39.457283Z","title":"Hellaswag: Can a machine really finish your sentence? In ACL (1) , pp.\\ 4791--4800","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.457283Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:96f66c3f83f5dafac39962e3d5efa3c3491ca9fa9a52bc9fbc43572ef323f247","observation_id":"bc53be10-ccfa-41e0-96e8-940cdf0fb801","resolution":{"observed_at":"2026-08-04T10:56:39.457283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17404","last_updated":"2025-06-28T12:44:53Z","snapshot_observed_at":"2026-08-07T15:59:35.050026Z","submitted_at":"2025-04-24T09:53:49Z","title":"Super Co-alignment of Human and AI for Sustainable Symbiotic Society","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17404","snapshot_observed_at":"2026-08-04T10:56:39.608269Z","title":"Redefining superalignment: From weak-to-strong alignment to human-ai co-alignment to sustainable symbiotic society","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.608269Z"},"links":{"cited_paper":"/paper/2504.17404","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:179b219d1f915315d6c58349988c09cc0e995fda9bc1a65b2f9d13a7f0752ca4","observation_id":"66fec589-19dc-4999-b23a-8aadeccacc50","resolution":{"observed_at":"2026-08-04T10:56:39.608269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15710","last_updated":"2024-03-11T07:50:05Z","snapshot_observed_at":"2026-08-13T04:54:14.515777Z","submitted_at":"2023-12-25T12:32:49Z","title":"Alleviating Hallucinations of Large Language Models through Induced Hallucinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15710","snapshot_observed_at":"2026-08-04T10:56:39.738631Z","title":"Alleviating hallucinations of large language models through induced hallucinations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.738631Z"},"links":{"cited_paper":"/paper/2312.15710","citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:1697c67accf8fedfa3e5209a8ca99fa8fe6977bd77affe51a42bc94eb36bb661","observation_id":"ade56135-cbbd-41a3-817f-b1f29d7066e7","resolution":{"observed_at":"2026-08-04T10:56:39.738631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:39.916024Z","title":"Emulated disalignment: Safety alignment for large language models may backfire! In ACL (1) , pp.\\ 15810--15830","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:39.916024Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:d272c9a4e04d4d16cc64935ac6779d5afd33f3bcdddd01f1bf2a227521df6416","observation_id":"bc500c42-524f-4d63-a4d2-0c23adcb98c8","resolution":{"observed_at":"2026-08-04T10:56:39.916024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:40.085756Z","title":"Weak-to-strong search: Align large language models via searching over small language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:40.085756Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:0729e5d023dc4fe333a5160db9c064826dae3f9cc8ef164fd81804841212a712","observation_id":"09dd1594-4bab-40a6-9d45-eb737314523a","resolution":{"observed_at":"2026-08-04T10:56:40.085756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:40.223461Z","title":"Weak-to-strong preference optimization: Stealing reward from weak aligned model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:40.223461Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:16e5db95f8523800a477d5c5ad126545e1e997b60c417f3e06d039d2df8ca733","observation_id":"7c718e00-c3e6-448a-8ace-42d97f9e5015","resolution":{"observed_at":"2026-08-04T10:56:40.223461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:40.403785Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:40.403785Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:b82e9540c331dfaee2f520f4768171685fa9a6e1c00f4c28146f527de2698925","observation_id":"bd336af9-09c1-4d11-ba37-fb97164a2e62","resolution":{"observed_at":"2026-08-04T10:56:40.403785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:40.556702Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:40.556702Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:598af33aac21c2d84b535e6893ff615b06f626023c61ae5f1a2cb28b514edd81","observation_id":"cec06a70-335c-47ce-933d-c5979d6294b5","resolution":{"observed_at":"2026-08-04T10:56:40.556702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:40.717856Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:40.717856Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:16384ef4c4046b92f825ee9e4655a11637323f44a46dd7a814f229ce8e420825","observation_id":"5a81682e-eaea-4ac5-a906-1d195366532a","resolution":{"observed_at":"2026-08-04T10:56:40.717856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:56:40.844714Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T10:56:40.844714Z"},"links":{"citing_paper":"/paper/2510.07884"},"observation_digest":"sha256:ef94d7fdf00d2c235979538dec72e371a8831567e2bed38d049faf5c79e18a8a","observation_id":"da11c7f1-93cc-4736-9b84-477819191c17","resolution":{"observed_at":"2026-08-04T10:56:40.844714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.07884","last_updated":"2026-07-28T08:23:49Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T17:37:43.100523Z","submitted_at":"2025-10-09T07:37:23Z","title":"Contrastive Weak-to-strong Generalization"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2510.07884."}