{"as_of":"2026-08-16T23:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b416eee3b864a8826ae0ed884d8e648f7e294c3386fc5c8b6c87da574099bda2","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:21:43.077882Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02726/citation-record","integrity":"/paper/2506.02726/integrity","json":"/paper/2506.02726/citation-record.json","paper":"/paper/2506.02726"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:47.649687Z","title":"Large language models: A survey of their development, capabilities, and applications.Knowledge and Information Systems, pages 1–56, 2024","venue":null,"work_id":"0f788742-66d3-4eac-a8f6-43a1cefa2835","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:38.818556Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:ec8a6eaf22d8729adbbee77b78b17550d19a7d857e68f04823d985a5540e4c29","observation_id":"35378862-893b-4597-b95b-05288e3f5877","resolution":{"observed_at":"2026-08-07T11:21:47.731516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:38.860198Z","title":"Nlp for social good: A survey of challenges, opportunities, and responsible deployment.arXiv preprint arXiv:2505.22327, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:38.860198Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:281ae217d0966463c0ac172e5e1762bd12d19a798bb248eb6e5f5c3883b21eee","observation_id":"d7bbc86f-e931-45c9-8953-57ef7582e0ec","resolution":{"observed_at":"2026-08-07T11:21:38.860198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:47.380462Z","title":"Current applications and challenges in large language models for patient care: a systematic review.Communications Medicine, 5(1):26, 2025","venue":null,"work_id":"b003895a-f20b-4d3f-9cf5-43989302afca","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:38.949163Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b0cc06f0946e2818f3b80bc9e93609952aed6c3c507474353d91fef58c055c06","observation_id":"bb19e456-97f4-405b-aae1-7bae18f537a2","resolution":{"observed_at":"2026-08-07T11:21:47.478778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04040","last_updated":"2025-02-09T08:00:36Z","snapshot_observed_at":"2026-08-15T09:18:34.265227Z","submitted_at":"2025-01-03T21:04:49Z","title":"A Survey on Large Language Models with some Insights on their Capabilities and Limitations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04040","snapshot_observed_at":"2026-08-07T11:21:39.055557Z","title":"A survey on large language models with some insights on their capabilities and limitations.arXiv preprint arXiv:2501.04040, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.055557Z"},"links":{"cited_paper":"/paper/2501.04040","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:3e2ae4b17a34e3e82bbd1e2456cec43571251a0bec5f03765036f0c23af1e514","observation_id":"57b394cb-018e-46af-be82-05bfc3318205","resolution":{"observed_at":"2026-08-07T11:21:39.055557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.094280Z","title":"Direct preference optimization: Your language model is secretly a reward model.Advances in Neural Information Processing Systems, 36:53728–53741, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.094280Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:e628a0202760622400c2d0ae7cc0fbb42aacaeea5b3334c024f51de56910348e","observation_id":"44ab70e2-1c85-4c56-a568-e9ce0a935689","resolution":{"observed_at":"2026-08-07T11:21:39.094280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10400","last_updated":"2025-02-24T08:57:10Z","snapshot_observed_at":"2026-08-15T21:48:04.229100Z","submitted_at":"2024-12-05T16:10:42Z","title":"Reinforcement Learning Enhanced LLMs: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10400","snapshot_observed_at":"2026-08-07T11:21:39.153862Z","title":"Reinforcement learning enhanced llms: A survey.arXiv preprint arXiv:2412.10400, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.153862Z"},"links":{"cited_paper":"/paper/2412.10400","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:4815a9b67fb37f923aff4c00bc696f5b6e05ddff44c34c4dc5902e203a30a9bc","observation_id":"74c35b06-33bc-4769-a41d-ee2412b33a4e","resolution":{"observed_at":"2026-08-07T11:21:39.153862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00125","last_updated":"2025-03-31T18:19:41Z","snapshot_observed_at":"2026-08-16T12:45:12.855025Z","submitted_at":"2025-03-31T18:19:41Z","title":"LLMs for Explainable AI: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00125","snapshot_observed_at":"2026-08-07T11:21:39.242160Z","title":"Llms for explainable ai: A comprehensive survey.arXiv preprint arXiv:2504.00125, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.242160Z"},"links":{"cited_paper":"/paper/2504.00125","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:78822bb142ed05e422e5b2e3653b4d919eb7268059dd7761f9f8e64cb87ea393","observation_id":"a381681a-455a-4ea2-9fb1-fabb69e82004","resolution":{"observed_at":"2026-08-07T11:21:39.242160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:47.221341Z","title":"Explainability for large language models: A survey.ACM Transactions on Intelligent Systems and Technology, 15(2):1–38, 2024","venue":null,"work_id":"57667dfc-150b-4df3-b3ad-4abc0c468016","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.392138Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f02046ecbd113ba33776134d2ffab9aafd751b4b74fc3823a4f40086c3438b64","observation_id":"ba7746db-7ab2-49c0-9c0d-d2fe3e7f91eb","resolution":{"observed_at":"2026-08-07T11:21:47.331458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.447414Z","title":"Understand what llm needs: Dual preference alignment for retrieval-augmented generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.447414Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:dee184f482b0b2a126bda52d0c13a9f64188423d330bea3dd8cb0b66102ecb21","observation_id":"ab4988a7-bbac-49a4-8d43-ae72784b60c7","resolution":{"observed_at":"2026-08-07T11:21:39.447414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.545398Z","title":"Chain of preference optimization: Improving chain-of-thought reasoning in llms.Advances in Neural Information Processing Systems, 37:333–356, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.545398Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:693db8bd9ca212fe5261672123a1aaf42dc78b8ae4143434de1272f18e6bc7d6","observation_id":"4f2b9230-9f4f-41fa-b65c-682f64177050","resolution":{"observed_at":"2026-08-07T11:21:39.545398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15280","last_updated":"2024-12-18T04:08:18Z","snapshot_observed_at":"2026-08-16T08:13:45.594489Z","submitted_at":"2024-12-18T04:08:18Z","title":"Context-DPO: Aligning Language Models for Context-Faithfulness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15280","snapshot_observed_at":"2026-08-07T11:21:39.613828Z","title":"Context-dpo: Aligning language models for context-faithfulness.arXiv preprint arXiv:2412.15280, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.613828Z"},"links":{"cited_paper":"/paper/2412.15280","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:085e6ab63be503b4f3e755016281be8bd90c86d0dd80de72b52d221e969ef13a","observation_id":"5faf9fb3-54ce-4de8-99ab-631bf7637757","resolution":{"observed_at":"2026-08-07T11:21:39.613828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14510","last_updated":"2024-12-19T04:18:51Z","snapshot_observed_at":"2026-08-16T14:51:47.244318Z","submitted_at":"2024-12-19T04:18:51Z","title":"PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization","version":1},"cited_work":{"arxiv_id":"2412.14510","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14510","snapshot_observed_at":"2026-08-07T11:21:44.107793Z","title":"PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization","venue":"cs.CL","work_id":"c59ca83a-383f-4bac-b7ba-c6a2bad503b1","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.749604Z"},"links":{"cited_paper":"/paper/2412.14510","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:ddd730dce6c26271b632383a5f4524074b49d76163fb2deaddea627c7db2981f","observation_id":"bb9969f1-74a8-4879-9709-705b98e488d6","resolution":{"observed_at":"2026-08-07T11:21:44.178173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.999577Z","title":"Knowpo: Knowledge-aware preference optimization for controllable knowledge selection in retrieval- augmented language models","venue":null,"work_id":"3c53244f-0eb3-4274-b030-f13628e51a39","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.821944Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:9b6f5eeb519cf4d56158f839d19548113f77fc97b3cd878e36761f6be3a00bc0","observation_id":"26010888-1271-453c-9889-bb799a52a1a3","resolution":{"observed_at":"2026-08-07T11:21:47.090260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:39.897385Z","title":"Iterative reasoning preference optimization.Advances in Neural Information Processing Systems, 37:116617–116637, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:39.897385Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:d32da1924f5aacf971a5e14c09e2cb41da48d6af68c846df9f149b58523329d5","observation_id":"9d28fa35-cf80-4ed3-9bc1-053bd929396d","resolution":{"observed_at":"2026-08-07T11:21:39.897385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18248","last_updated":"2024-07-25T17:59:16Z","snapshot_observed_at":"2026-08-16T13:30:59.472495Z","submitted_at":"2024-07-25T17:59:16Z","title":"Self-Training with Direct Preference Optimization Improves Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18248","snapshot_observed_at":"2026-08-07T11:21:40.015790Z","title":"Self-training with direct preference optimization improves chain-of- thought reasoning.arXiv preprint arXiv:2407.18248, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.015790Z"},"links":{"cited_paper":"/paper/2407.18248","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:8e104e0a7c16c233508477bf3ad822742c482ef8a13ca6467d10cae021e33c0e","observation_id":"903b4620-bbfa-4740-b989-c9aa6a4f3c2d","resolution":{"observed_at":"2026-08-07T11:21:40.015790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11181","last_updated":"2024-03-27T13:51:04Z","snapshot_observed_at":"2026-08-16T14:09:05.486230Z","submitted_at":"2024-03-17T11:55:35Z","title":"Solving Maxwell's Equations","version":2},"cited_work":{"arxiv_id":"2403.11181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11181","snapshot_observed_at":"2026-08-07T11:21:43.912022Z","title":"Solving Maxwell's Equations","venue":"physics.gen-ph","work_id":"5a38dd42-be6e-4080-a172-389ea39a1607","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.090748Z"},"links":{"cited_paper":"/paper/2403.11181","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:218e84a7e00e5d5c89a0d2fd88aa8f39c6764626ee02f7bb03fe7b576eccd56e","observation_id":"a6cab298-93e4-432d-a3cd-31d582c665e6","resolution":{"observed_at":"2026-08-07T11:21:44.000302Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10677","last_updated":"2026-07-20T09:35:34Z","snapshot_observed_at":"2026-08-16T12:51:18.235139Z","submitted_at":"2025-03-11T01:59:35Z","title":"A Survey on Knowledge-Oriented Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10677","snapshot_observed_at":"2026-08-07T11:21:40.158290Z","title":"A survey on knowledge-oriented retrieval-augmented generation.arXiv preprint arXiv:2503.10677, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.158290Z"},"links":{"cited_paper":"/paper/2503.10677","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:62cbfe2bc1564e18d3cb581b93e9115fa7cb5287f42406172f911f0104924ab2","observation_id":"a9a06361-e0ee-4ac3-abe2-d72c8f9d7519","resolution":{"observed_at":"2026-08-07T11:21:40.158290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:40.284051Z","title":"Chain-of-thought prompting elicits reasoning in large language models.Advances in neural information processing systems, 35:24824–24837, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.284051Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:217769ade59538bbc981d1a4e5ce1cd54d8bc97c523e73f1c915591b14e0f82d","observation_id":"23df82cc-59c2-4a25-bebe-450afeb4def6","resolution":{"observed_at":"2026-08-07T11:21:40.284051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06072","last_updated":"2025-08-01T01:52:05Z","snapshot_observed_at":"2026-08-16T12:51:59.712632Z","submitted_at":"2025-03-08T05:41:42Z","title":"A Survey on Post-training of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06072","snapshot_observed_at":"2026-08-07T11:21:40.383980Z","title":"A survey on post-training of large language models.arXiv preprint arXiv:2503.06072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.383980Z"},"links":{"cited_paper":"/paper/2503.06072","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:2971d3c185c3b4f9881b1e0494e5bff48079d98b18ab1c9689123de791d84ea1","observation_id":"fa508398-e9cd-4894-bbe0-055d2e765f73","resolution":{"observed_at":"2026-08-07T11:21:40.383980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17003","last_updated":"2025-05-05T01:21:53Z","snapshot_observed_at":"2026-08-16T12:48:00.940637Z","submitted_at":"2025-03-21T10:09:16Z","title":"A Survey on Personalized Alignment -- The Missing Piece for Large Language Models in Real-World Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17003","snapshot_observed_at":"2026-08-07T11:21:40.479121Z","title":"A survey on personalized alignment–the missing piece for large language models in real-world applications.arXiv preprint arXiv:2503.17003, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.479121Z"},"links":{"cited_paper":"/paper/2503.17003","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:3cb57630ae1ad430008a3388f17ded2156a1be0914a5814176bdf44e09f1abcf","observation_id":"fdf48b54-8869-47c6-bf9a-03f922f803a9","resolution":{"observed_at":"2026-08-07T11:21:40.479121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10391","last_updated":"2025-02-14T18:59:51Z","snapshot_observed_at":"2026-08-08T01:24:46.892879Z","submitted_at":"2025-02-14T18:59:51Z","title":"MM-RLHF: The Next Step Forward in Multimodal LLM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10391","snapshot_observed_at":"2026-08-07T11:21:40.615790Z","title":"Mm-rlhf: The next step forward in multimodal llm alignment.arXiv preprint arXiv:2502.10391, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.615790Z"},"links":{"cited_paper":"/paper/2502.10391","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:c81429beee452ba7ef6e203b4aa6e28ca671ca0fe276c2929e1512461a649c72","observation_id":"9b0ec985-fb2e-429e-bbeb-c23793eb36c8","resolution":{"observed_at":"2026-08-07T11:21:40.615790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18252","last_updated":"2025-04-26T08:33:32Z","snapshot_observed_at":"2026-08-16T14:31:19.921863Z","submitted_at":"2024-10-23T19:59:50Z","title":"Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18252","snapshot_observed_at":"2026-08-07T11:21:40.684605Z","title":"Asynchronous rlhf: Faster and more efficient off-policy rl for language models.arXiv preprint arXiv:2410.18252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.684605Z"},"links":{"cited_paper":"/paper/2410.18252","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b29e07ffed134cac952bef74271d1ffcf903e4d3aabdcd89084a1f47cca9b583","observation_id":"0204eac1-f9af-4dc2-881c-4b43e76c53fe","resolution":{"observed_at":"2026-08-07T11:21:40.684605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08617","last_updated":"2025-06-10T03:19:33Z","snapshot_observed_at":"2026-08-16T15:06:48.802512Z","submitted_at":"2025-01-15T06:33:15Z","title":"RLHS: Mitigating Misalignment in RLHF with Hindsight Simulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08617","snapshot_observed_at":"2026-08-07T11:21:40.801007Z","title":"Rlhs: Mitigating misalign- ment in rlhf with hindsight simulation.arXiv preprint arXiv:2501.08617, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.801007Z"},"links":{"cited_paper":"/paper/2501.08617","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:8301582cc7db59f34bfda375b7c92164dba397bd8e07c84e787144c58ab153dd","observation_id":"0434a918-f900-4b85-946d-c03d54180b4b","resolution":{"observed_at":"2026-08-07T11:21:40.801007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-16T04:57:30.418363Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-07T11:21:40.927940Z","title":"Reinforce++: A simple and efficient approach for aligning large language models.arXiv preprint arXiv:2501.03262, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:40.927940Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:40081d4cbe87111ee06435690216953bb2aebef6b22cbd52c1d0868e14091eb6","observation_id":"82e0992e-7473-4faf-b2b3-07506c9ccda4","resolution":{"observed_at":"2026-08-07T11:21:40.927940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21046","last_updated":"2024-05-31T17:39:06Z","snapshot_observed_at":"2026-08-16T13:47:19.929213Z","submitted_at":"2024-05-31T17:39:06Z","title":"Exploratory Preference Optimization: Harnessing Implicit Q*-Approximation for Sample-Efficient RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21046","snapshot_observed_at":"2026-08-07T11:21:41.016055Z","title":"Exploratory preference optimization: Harnessing implicit q*-approximation for sample-efficient rlhf.arXiv preprint arXiv:2405.21046, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.016055Z"},"links":{"cited_paper":"/paper/2405.21046","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:1678957e6d13a27beba3712a913e44e58ba226b05bbda2d0f313030f14c9f7b3","observation_id":"12271706-1c52-45c2-9b33-393f1be2538e","resolution":{"observed_at":"2026-08-07T11:21:41.016055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.649162Z","title":null,"venue":null,"work_id":"c5c4df00-713a-4f90-bef1-9230ea872e89","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.058198Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:485a3e2a1c5d3475f506382fdae1bb2eaafb915427613d6fc75cc91b5349131c","observation_id":"fad7e606-d01f-4894-84a3-b0e44b075c91","resolution":{"observed_at":"2026-08-07T11:21:46.854469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08685","last_updated":"2024-03-31T22:42:03Z","snapshot_observed_at":"2026-08-16T14:43:12.630220Z","submitted_at":"2023-11-15T04:22:22Z","title":"Safer-Instruct: Aligning Language Models with Automated Preference Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08685","snapshot_observed_at":"2026-08-07T11:21:41.130792Z","title":"Safer-instruct: Aligning language models with automated preference data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.130792Z"},"links":{"cited_paper":"/paper/2311.08685","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:2a84be61dddeab6f9d66d6995e9f28c2eb132e258cbd4e9c7012495cad7bb4c3","observation_id":"bbe81107-5f30-4627-ad40-7fa6c65256cc","resolution":{"observed_at":"2026-08-07T11:21:41.130792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06961","last_updated":"2024-10-09T14:57:31Z","snapshot_observed_at":"2026-08-16T13:11:04.470639Z","submitted_at":"2024-10-09T14:57:31Z","title":"Self-Boosting Large Language Models with Synthetic Preference Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06961","snapshot_observed_at":"2026-08-07T11:21:41.210733Z","title":"Self-boosting large language models with synthetic preference data.arXiv preprint arXiv:2410.06961, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.210733Z"},"links":{"cited_paper":"/paper/2410.06961","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:d6928b9fec56323cff96a05b21e571249d55e122b8d7da8ecfa4141900f02dcf","observation_id":"710738de-a91c-4664-8a43-71f3c1dc08e5","resolution":{"observed_at":"2026-08-07T11:21:41.210733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.422316Z","title":"A comprehensive review of large language models: issues and solutions in learning environments.Discover Sustainability, 6(1):27, 2025","venue":null,"work_id":"fa9f9a7d-447f-4441-897f-959ced31aa22","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.269690Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:eeb72c51e88af17f2dadf6756a11754f76969d5a97eb7cebaa3be3e48f676544","observation_id":"a28d5641-84b1-4e89-a0e7-5e53d514116e","resolution":{"observed_at":"2026-08-07T11:21:46.524500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T11:21:41.322841Z","title":"Constitutional ai: Harmlessness from ai feedback.arXiv preprint arXiv:2212.08073, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.322841Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:0b21bba34766434eae481af935ce277875f41d53a30e8f3c476cd823fcf5ea06","observation_id":"148f7fa5-3df2-48f8-93f9-b611bc3a5f75","resolution":{"observed_at":"2026-08-07T11:21:41.322841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:46.221836Z","title":"Zhang and J","venue":null,"work_id":"5ede79df-ce0f-450d-b67b-f5eeaeb3a0c7","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.393033Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:7936d782549cc21df0a9a7db739f3abd697a053e26cf381737f8c46ba7ae8774","observation_id":"cdf321d2-69d2-4864-8466-81151cfdede6","resolution":{"observed_at":"2026-08-07T11:21:46.337621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T11:21:41.484804Z","title":"Retrieval-augmented generation for large language models: A survey.arXiv preprint arXiv:2312.10997, 2(1), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.484804Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b48fc86d18e08c75e167ec01092a31253f74bb10bc1a6327959360aeb799bc3d","observation_id":"3535564f-345b-4253-9118-ffd667784e46","resolution":{"observed_at":"2026-08-07T11:21:41.484804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.937748Z","title":null,"venue":null,"work_id":"c9267f30-1e84-489d-90d4-e3d1a3c81396","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.550399Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:7bdfbea541d2e3c4bc1143f7a860f53f4f67e816f1dd979e6a137310f856c2d3","observation_id":"f5a0a599-c7ff-48f5-93b9-bc6aa98de06c","resolution":{"observed_at":"2026-08-07T11:21:46.013978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.803929Z","title":"Wang and Y","venue":null,"work_id":"5cce84ca-fc0b-4d67-9886-75f3a6a6fbdd","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.601069Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:dafed375e458d70cd31ffad2a6256601339deaa38ee63cdcf533897a5a55fd61","observation_id":"4a09417b-8f90-4f45-8b86-de503559f55b","resolution":{"observed_at":"2026-08-07T11:21:45.870818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.651250Z","title":"Feng and L","venue":null,"work_id":"359a381e-81ec-419e-ad52-b3a31dbc1284","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.653470Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:44f9050ed5214f0440750826019d3fce834d358c154140a73710eb13082d330f","observation_id":"a92a8db8-8f5d-4ba3-9e81-588b0fa43f84","resolution":{"observed_at":"2026-08-07T11:21:45.725340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00309","last_updated":"2025-01-08T05:16:25Z","snapshot_observed_at":"2026-08-15T15:30:31.504538Z","submitted_at":"2024-12-31T06:59:35Z","title":"Retrieval-Augmented Generation with Graphs (GraphRAG)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00309","snapshot_observed_at":"2026-08-07T11:21:41.722040Z","title":"Retrieval-augmented generation with graphs (graphrag)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.722040Z"},"links":{"cited_paper":"/paper/2501.00309","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:175e1ac92c7c3619f0ee49ccb65e74b1ab4d59cd4cd4301c02be62071b62114b","observation_id":"aedea759-c1d4-422f-bc74-d0649ca28f24","resolution":{"observed_at":"2026-08-07T11:21:41.722040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04736","last_updated":"2025-04-28T01:20:59Z","snapshot_observed_at":"2026-08-16T12:43:30.161882Z","submitted_at":"2025-04-07T05:20:58Z","title":"Synthetic Data Generation & Multi-Step RL for Reasoning & Tool Use","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04736","snapshot_observed_at":"2026-08-07T11:21:41.804315Z","title":"Synthetic data generation & multi-step rl for reasoning & tool use.arXiv preprint arXiv:2504.04736, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.804315Z"},"links":{"cited_paper":"/paper/2504.04736","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:ca146e854002c6ba654c4917d5c2f6b71d78d64c144c21a9607746c376e434a3","observation_id":"a8369b8b-1fca-444f-92c3-4f022cc3f304","resolution":{"observed_at":"2026-08-07T11:21:41.804315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.478737Z","title":"Enhancing chain of thought prompting in large language models via reasoning patterns","venue":null,"work_id":"bbf16a09-aa9f-40d2-af79-aa3ca80a2572","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.874814Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:2a135bfb48cab88c565b3f7ae25594f49acedba3be7e0b1e459dd988a561cfb8","observation_id":"a465f5ba-829c-4790-8c3e-56fc59df58af","resolution":{"observed_at":"2026-08-07T11:21:45.550033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08633","last_updated":"2025-03-11T14:26:41Z","snapshot_observed_at":"2026-08-16T13:10:24.858485Z","submitted_at":"2024-10-11T08:55:17Z","title":"Transformers Provably Solve Parity Efficiently with Chain of Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08633","snapshot_observed_at":"2026-08-07T11:21:41.931755Z","title":"Transformers provably solve parity efficiently with chain of thought.arXiv preprint arXiv:2410.08633, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.931755Z"},"links":{"cited_paper":"/paper/2410.08633","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:73716755684353f56233a81c9543b80aa8677617976674e80be5ed179f4cfd55","observation_id":"09bcebd1-1f60-478e-90b7-79b246d1c87f","resolution":{"observed_at":"2026-08-07T11:21:41.931755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-16T12:55:14.600973Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-07T11:21:41.999082Z","title":"Chain of draft: Thinking faster by writing less.arXiv preprint arXiv:2502.18600, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:41.999082Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:5ab257115d8bb5786d9f98bcb393cf4570651e9438a43ef81d4a689cb55f3760","observation_id":"43ec6d05-cebe-4146-a919-e602bba05855","resolution":{"observed_at":"2026-08-07T11:21:41.999082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:42.046502Z","title":"Tool learning with large language models: A survey.Frontiers of Computer Science, 19(8):198343, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.046502Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:8f64e1f0dfa85d555d507edbdb61019a238b4971b570a60f7c297ae71671096b","observation_id":"4f1fe121-7f15-46fa-906c-5d85df9b3985","resolution":{"observed_at":"2026-08-07T11:21:42.046502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02144","last_updated":"2023-09-05T11:32:48Z","snapshot_observed_at":"2026-08-16T15:03:13.909629Z","submitted_at":"2023-09-05T11:32:48Z","title":"Making Large Language Models Better Reasoners with Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02144","snapshot_observed_at":"2026-08-07T11:21:42.079243Z","title":"Making large language models better reasoners with alignment.arXiv preprint arXiv:2309.02144, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.079243Z"},"links":{"cited_paper":"/paper/2309.02144","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:444758676d4a1cc785069b5ebed56e419d51b3e11cbbead5c38f6dab7a443881","observation_id":"b3030e9e-68e9-480a-9bf1-70470f0c9d15","resolution":{"observed_at":"2026-08-07T11:21:42.079243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16061","last_updated":"2025-02-04T20:29:39Z","snapshot_observed_at":"2026-08-16T13:40:25.408784Z","submitted_at":"2024-06-23T09:51:06Z","title":"PORT: Preference Optimization on Reasoning Traces","version":2},"cited_work":{"arxiv_id":"2406.16061","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16061","snapshot_observed_at":"2026-08-07T11:21:43.557177Z","title":"PORT: Preference Optimization on Reasoning Traces","venue":"cs.LG","work_id":"c1c2c4e3-2cc8-4305-a79d-8a63d2b01552","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.154602Z"},"links":{"cited_paper":"/paper/2406.16061","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:a4063ac5d8bb55d50e09cceb79f48ef0a475a91e3e94ecbf77ff01a6b0abc74c","observation_id":"e9913d1b-478a-4d3d-b1c3-a4700efdfbb5","resolution":{"observed_at":"2026-08-07T11:21:43.674287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15676","last_updated":"2025-02-05T22:01:59Z","snapshot_observed_at":"2026-08-16T13:58:17.880393Z","submitted_at":"2024-04-24T06:12:00Z","title":"Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15676","snapshot_observed_at":"2026-08-07T11:21:42.204519Z","title":"Beyond chain-of-thought: A survey of chain-of-x paradigms for llms.arXiv preprint arXiv:2404.15676, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.204519Z"},"links":{"cited_paper":"/paper/2404.15676","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:dde01f8da79b807e5340f7fe85413b3dbbe819a912a5fe6b5a9732384cf96224","observation_id":"e709ee68-ea43-4f99-907c-ab3a2df57a1d","resolution":{"observed_at":"2026-08-07T11:21:42.204519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.281086Z","title":"Preference tree optimization: Enhancing goal- oriented dialogue with look-ahead simulations","venue":null,"work_id":"ecf2591c-5f59-4121-a5f4-6601fd144485","year":null},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.271188Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:207794bc860ef48108f5192209033de2cfd4204d23856e95ea81f3bdb8e0fb5a","observation_id":"22ae8ed5-37c1-4c8a-95fe-75f8c167d131","resolution":{"observed_at":"2026-08-07T11:21:45.372913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:45.129946Z","title":"Large language models in traditional chinese medicine: A scoping review.Journal of Evidence-Based Medicine, 18(1):e12658, 2025","venue":null,"work_id":"374da69a-e4ac-4e25-bf15-84cc8e3d2dac","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.326058Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f14367352c2a0fde307e6d37787f6e6b60305623b1b8e6637f199bd8a47ceade","observation_id":"f98649cf-13d2-4964-9fa3-e4f9334cfae4","resolution":{"observed_at":"2026-08-07T11:21:45.203522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.981352Z","title":"Tcmchat: A generative large language model for traditional chinese medicine.Pharmacological Research, 210:107530, 2024","venue":null,"work_id":"64aa5e8b-018f-4314-9841-16ff0de7dcff","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.411645Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:39a65436d7c1c8ecd7abef68072d603f94ea61e6ffe432af9f994e0d35817aac","observation_id":"06d4c3d7-50f9-45b8-aae0-cfddaa4ce002","resolution":{"observed_at":"2026-08-07T11:21:45.046715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.11027","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:43.295106Z","title":"Biancang: A traditional chinese medicine large language model.arXiv preprint arXiv:2411.11027, 2024","venue":null,"work_id":"eb60e979-a486-4429-a94f-3140655456cf","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.480389Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:0e0117de9dcaa0e2f99b479ed06c154cfa9897be40ab427b661df0f807f21eb1","observation_id":"e99d14b3-39d3-4263-8b86-4882bb6c85ab","resolution":{"observed_at":"2026-08-07T11:21:43.446236Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16056","last_updated":"2024-06-22T05:43:53Z","snapshot_observed_at":"2026-08-16T14:07:00.063434Z","submitted_at":"2024-03-24T07:48:05Z","title":"Qibo: A Large Language Model for Traditional Chinese Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16056","snapshot_observed_at":"2026-08-07T11:21:42.548438Z","title":"Qibo: A large language model for traditional chinese medicine.arXiv preprint arXiv:2403.16056, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.548438Z"},"links":{"cited_paper":"/paper/2403.16056","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:494514b9864238ea909a5b484fe4ff09b40f45ec5d97a0c6118675549f6b2578","observation_id":"17d4fd0d-80d0-4afe-b56d-8bcd6eb95937","resolution":{"observed_at":"2026-08-07T11:21:42.548438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.862710Z","title":"Ai-powered lawyering: Ai reasoning models, retrieval augmented generation, and the future of legal practice","venue":null,"work_id":"bf1cd7bb-0dcf-4430-92e0-5adff4139e75","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.619817Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:f5405b0f79f060a698ec96336f7496545b353f8ecc7a3724fa957f2493122e08","observation_id":"2ea30630-77fc-4016-a820-90eff300a36a","resolution":{"observed_at":"2026-08-07T11:21:44.913465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.720112Z","title":"A comprehensive review on financial explainable ai.Artificial Intelligence Review, 58(6):1–49, 2025","venue":null,"work_id":"cc182a14-2d4c-4eb1-a088-962dfd5ebbc6","year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.699536Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:bf7d6844312998c9796a76b4e765c67ee1c352edead22eb0a086d4d00a501af7","observation_id":"645540cd-f7b2-4593-be27-28e96ffafad7","resolution":{"observed_at":"2026-08-07T11:21:44.785971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.541665Z","title":"Findings of the association for computational linguistics: Eacl 2024","venue":null,"work_id":"a0981011-779b-43ea-a514-dfd33143b786","year":2024},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.746394Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:76f9a122c1809e0d19300a3904becd1b4872cf1e9193d8d87ed00e35af3e2a44","observation_id":"0595f1a3-41d5-4292-913c-e2cba6ba271f","resolution":{"observed_at":"2026-08-07T11:21:44.608922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14860","last_updated":"2025-08-11T03:23:40Z","snapshot_observed_at":"2026-08-16T12:56:33.345679Z","submitted_at":"2025-02-20T18:59:31Z","title":"ALFA: Aligning LLMs to Ask Good Questions A Case Study in Clinical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14860","snapshot_observed_at":"2026-08-07T11:21:42.818394Z","title":"Aligning llms to ask good questions a case study in clinical reasoning.arXiv preprint arXiv:2502.14860, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.818394Z"},"links":{"cited_paper":"/paper/2502.14860","citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b44cf78f534914af203457c85363f36fbe67c1d00d3d33912e35f16a9fa3263e","observation_id":"673dff5e-42c1-4845-97dc-2fade4c69f74","resolution":{"observed_at":"2026-08-07T11:21:42.818394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:44.380657Z","title":"Shennong-tcm: A traditional chinese medicine large language model","venue":null,"work_id":"aee021bc-3be5-4608-869d-7b443b464fcb","year":2023},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.914094Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:6292e325f51fe66ae04962c25d5d077fb3695c5e2c7a3a4b44c863544adb57ee","observation_id":"6dfbdf6e-383e-4290-b84e-a2609ada25ee","resolution":{"observed_at":"2026-08-07T11:21:44.433484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:42.986811Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:42.986811Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:eb3d70957481304fa209c13f1bf3227cfad5ef8689844dbb95b1bc130e9f9369","observation_id":"aada8a85-a2e7-412f-bb92-483f6a257300","resolution":{"observed_at":"2026-08-07T11:21:42.986811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:21:43.077882Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:21:43.077882Z"},"links":{"citing_paper":"/paper/2506.02726"},"observation_digest":"sha256:b70bc8c53b7bced50bc093b98be70eabbbc33f6cf4b52862c332568dcd4c2774","observation_id":"5f72547f-2c79-4385-95ec-873c5c2c23f2","resolution":{"observed_at":"2026-08-07T11:21:43.077882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02726","last_updated":"2025-06-03T10:36:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T14:38:31.928986Z","submitted_at":"2025-06-03T10:36:38Z","title":"RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":36,"verified_exact":3,"verified_fuzzy":16},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2506.02726."}