{"as_of":"2026-08-10T04:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9984b532cdc2a2c780f6873cb7339fcc998ca7e4b536031fcbf0d93b14567c8c","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:16:17.842335Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00152/citation-record","integrity":"/paper/2506.00152/integrity","json":"/paper/2506.00152/citation-record.json","paper":"/paper/2506.00152"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.787519Z","title":"How ai outperforms humans at creative idea generation","venue":null,"work_id":"3728ca40-517c-4ba0-b860-7ffb06bfbf28","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.199586Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:b9c73a826938ee273c1dd1030169c1fd1c9943ff20091210652a2f41596fa6f1","observation_id":"c01c58dc-46a1-4004-9c0b-838f4a9ef487","resolution":{"observed_at":"2026-08-07T12:16:21.862335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.575061Z","title":"Ai–human hybrids for marketing research: Leveraging large language models (llms) as collaborators","venue":null,"work_id":"1a9a0062-c376-4c19-8e23-1464aad597f3","year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.274735Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:33e1374b095339487fe5e2f285233b5492d60ad25733b75cf7af73fbcf7752ec","observation_id":"f31d8b2a-4c52-4119-add1-707b0bd7539f","resolution":{"observed_at":"2026-08-07T12:16:21.719018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.247264Z","title":"Frontiers: Can large language models capture human prefer- ences? Marketing Science, 43(4):709–722, 2024","venue":null,"work_id":"b1d19b84-2cf1-40bd-9490-82a99aba0815","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.329272Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5051edb9e1dcf32300b105d0c2fd56aaf511b2941dd4d1d91284cec1c4b122ad","observation_id":"afd87cce-6043-4ae9-ade5-b60d56f90e14","resolution":{"observed_at":"2026-08-07T12:16:21.378710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02611","last_updated":"2024-11-26T18:51:57Z","snapshot_observed_at":"2026-08-09T00:57:06.459212Z","submitted_at":"2024-06-03T07:56:58Z","title":"LOLA: LLM-Assisted Online Learning Algorithm for Content Experiments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02611","snapshot_observed_at":"2026-08-07T12:16:14.436321Z","title":"Lola: Llm-assisted online learning algorithm for content experiments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.436321Z"},"links":{"cited_paper":"/paper/2406.02611","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:317d65c7dcd942906caaf4de43e69ffb149e68d3e4053225bc91988a938b0673","observation_id":"6846cab9-cc19-47e6-a3ce-bd099f0400b1","resolution":{"observed_at":"2026-08-07T12:16:14.436321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01957","last_updated":"2025-05-01T17:40:14Z","snapshot_observed_at":"2026-08-09T00:57:38.984665Z","submitted_at":"2024-10-02T19:03:42Z","title":"Challenges and Future Directions of Data-Centric AI Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01957","snapshot_observed_at":"2026-08-07T12:16:14.584356Z","title":"How reliable is human feedback for aligning large language models? arXiv preprint arXiv:2410.01957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.584356Z"},"links":{"cited_paper":"/paper/2410.01957","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4302beea04f9a1c009c6c19ed21f3c0d00e6fb50212e972744e6d4abe2f53603","observation_id":"782aba1f-e6cb-4374-a701-b56451811f89","resolution":{"observed_at":"2026-08-07T12:16:14.584356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:21.076656Z","title":"A/b testing: A systematic literature review","venue":null,"work_id":"12cd624a-ed37-497d-b4a4-c83619d9a771","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.691279Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:d74c6bd6375cd36271947a89507a9dfc2e9ca678f97f85c46679ead4dac4c70e","observation_id":"27be85ee-4e45-4465-813a-2cb4eaa498c1","resolution":{"observed_at":"2026-08-07T12:16:21.155978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:14.782289Z","title":"Causal alignment: Augmenting language models with a/b tests","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.782289Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:e365e231a547d5b54a2ca938a840b12bd80c383a4a2497536d7037e57940d904","observation_id":"1304c1b3-7cf6-4b4f-b5fc-b527e17c1310","resolution":{"observed_at":"2026-08-07T12:16:14.782289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.07238","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.373549Z","title":"Using advanced llms to enhance smaller llms: An interpretable knowledge distillation approach","venue":null,"work_id":"b61ef70f-6df3-436a-a048-30b02a4e919f","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.857940Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:b408fe6e47634b0ba5113e7ce3ddf0f810037ecdee6082f08528984d87e2a944","observation_id":"8653298e-2855-4c80-b5a5-42532f56fab3","resolution":{"observed_at":"2026-08-07T12:16:18.468656Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.851057Z","title":"Test & roll: Profit-maximizing a/b tests","venue":null,"work_id":"34b17b3a-842b-4d19-8f1a-93852be8aa8a","year":2019},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:14.936266Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:5b678a7f0b4d9152a333cfe044385a9b6b4c325e22284d087c1d96bc78d20c07","observation_id":"f01b1c0a-05a2-43f4-83de-fea84e624f49","resolution":{"observed_at":"2026-08-07T12:16:20.952564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.630455Z","title":"An empirical meta-analysis of e-commerce a/b testing strategies","venue":null,"work_id":"57aeb3a2-11f4-4ecc-b1e5-0a03a2cb63c4","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.032629Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:3489cd3350ea5bb12d482dad5076c5c132d7a7e8a3024ce4c12c8cc85c1e09dd","observation_id":"87253cb1-f801-432d-bdea-fbb23aa2948b","resolution":{"observed_at":"2026-08-07T12:16:20.744955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.103600Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.103600Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:63164477c10e571dc00c9e2fe9206331ca745177dfc23a3c0c0a2ea44f1ce8fb","observation_id":"1395be67-84f5-406e-a8d9-835b1a721668","resolution":{"observed_at":"2026-08-07T12:16:15.103600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.175631Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.175631Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:01c96fa42d13ad8c75c087173ae9d34e221bef2c4075c8c999cc22b68d925bc2","observation_id":"1cdda42c-2864-4fcc-98e6-63524a7aad59","resolution":{"observed_at":"2026-08-07T12:16:15.175631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.267425Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.267425Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4e4a95a70e44fabed0b54db8a16996cebff09fbf014fc4627cab56cf1d7f40b6","observation_id":"c4fbbd3e-4590-4657-83e2-9b8471d94855","resolution":{"observed_at":"2026-08-07T12:16:15.267425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.350248Z","title":"The importance of human-labeled data in the era of llms","venue":null,"work_id":"aace9e42-2ad6-43df-9ebd-0be4caf0a12b","year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.350394Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:11d3698b795e9f03431b9696377a85a12bd544213da673a30c5c2690ae6e9146","observation_id":"19e5775a-1770-4bdd-b367-a0ee4092b2a6","resolution":{"observed_at":"2026-08-07T12:16:20.458336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.448497Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.448497Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:153322868343a3cb744183697990488e6113622ed1938db562e23ca9129fccbe","observation_id":"d37f9bd2-4b6f-4a95-a0ad-9ad7914a76d4","resolution":{"observed_at":"2026-08-07T12:16:15.448497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:20.125856Z","title":"Scaling laws for reward model overoptimization in direct alignment algorithms","venue":null,"work_id":"cae23afe-1c61-4119-9abf-995b69abaa1d","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.508979Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:7c6f9997ec95d37a8240dce1a220018a2f9dd76a36de9fd30812b16e0a41d96e","observation_id":"52856e02-4a99-4368-bd32-d4e6a38b8a78","resolution":{"observed_at":"2026-08-07T12:16:20.241078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T12:16:15.576254Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.576254Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:8b5e193f538ccb3b2d045fc0f5bca980b5b16f5eb907871948422a7f37b994b2","observation_id":"dc2dd242-8485-4e6a-930e-aaca2b364761","resolution":{"observed_at":"2026-08-07T12:16:15.576254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.917416Z","title":"RLAIF: Scal- ing reinforcement learning from human feedback with AI feedback, 2024","venue":null,"work_id":"db5205fb-8473-411b-b13e-33f874cf88d4","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.641137Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:cf213df92fe97e819b2c4ef9abeb7bd6d15d9d4bba044673907d2c0888b14810","observation_id":"d3240d1f-c082-4435-8769-cf59db7c3518","resolution":{"observed_at":"2026-08-07T12:16:20.015498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:16:15.716062Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.716062Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:0f59adb7b367d89d1f56bcf00b9943cb2054bf4c24417004221eca26eee5537b","observation_id":"a1ae2e67-47ec-4273-961f-b4052573685a","resolution":{"observed_at":"2026-08-07T12:16:15.716062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T12:16:15.782738Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.782738Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:fb5bd4ba53181c809db7d9466daba485792e281ef044896e2cad192f4b4f6c12","observation_id":"480d506a-8742-4f8c-8b15-36439fc36f17","resolution":{"observed_at":"2026-08-07T12:16:15.782738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.820659Z","title":"The upworthy research archive, a time series of 32,487 experiments in us media","venue":null,"work_id":"901340cb-d56c-4c6b-ba72-669af186b29b","year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.889787Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:7aab4f87d83f47dbed13c3d0cfbd5f608369e1e90012eb6ebb790a23fca64767","observation_id":"aaacbc1b-e606-4515-969b-55cc7792ebc4","resolution":{"observed_at":"2026-08-07T12:16:19.855934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:15.951592Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:15.951592Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:a31ec1be7494e0f5bb8ec0e76ee98640af5d97f147fc88e58a88e525adc7e963","observation_id":"b83ca2f0-ed9d-4ed0-a290-b717dab7fc04","resolution":{"observed_at":"2026-08-07T12:16:15.951592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.686941Z","title":"Double/debiased machine learning for treatment and structural parameters","venue":null,"work_id":"3b1b3c8e-765e-47aa-91c9-1c3393b57d53","year":2018},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.038335Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:f53f9d15f2bdd1f3ae8179ec2b34fc79f59b3760be1b7544e8d419cbdb4fb816","observation_id":"701f88d8-2126-41e2-b4aa-0934efbfa74d","resolution":{"observed_at":"2026-08-07T12:16:19.753711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.565962Z","title":"Minimax estimation of conditional moment models","venue":null,"work_id":"b7e45cb2-e466-44de-9bfa-1ad8d222a094","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.117623Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:bfffc2e6d962cf214c1a5bf4ca90d31a75c3b85c3320ead127d5de8928bb638a","observation_id":"65f8d39b-6f2e-4437-a4f6-2610d9fae4a8","resolution":{"observed_at":"2026-08-07T12:16:19.625610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.435359Z","title":"Mind: A large-scale dataset for news recommendation","venue":null,"work_id":"28e00933-6abe-4616-a236-e38f6a33afc9","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.213931Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:f72056b09b54035fa60856423d558b9cfef01f9873756f520ecb474cc46d16b4","observation_id":"1100beae-4776-418e-9d8d-4350b6df5d89","resolution":{"observed_at":"2026-08-07T12:16:19.491351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.289802Z","title":"Generative brand choice","venue":null,"work_id":"c78b4443-4c4f-4a50-94af-8a09d8fd269a","year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.324319Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:d4d1f69e140169d26e87fd43c7d045334408f52cb4d437d0a2b47470329d57f7","observation_id":"447989a9-e58f-42f3-8c2c-84d434e6fd98","resolution":{"observed_at":"2026-08-07T12:16:19.360338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.189688Z","title":"Deep neural networks for estimation and inference","venue":null,"work_id":"5448fa28-0675-4334-aa83-41ff32d0087f","year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.439142Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4a393942dd303b5a5820240eb31b38eecc89c3ff838e5865d2bdfb72d71cab45","observation_id":"873e0199-de5f-45a7-8d8f-68a9106cb74a","resolution":{"observed_at":"2026-08-07T12:16:19.222244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.131739Z","title":"Deep generalized method of moments for instrumental variable analysis","venue":null,"work_id":"4244b661-b07b-4dc8-ba91-c6e92521427e","year":2019},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.546057Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:3ec0c2b2c60a35d30d696ffb9dcb3cf40b7e0978ed29047ddd574d6521cecb89","observation_id":"9ee94596-7af0-49a8-9bb8-96f8d995be3a","resolution":{"observed_at":"2026-08-07T12:16:19.159180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:19.078675Z","title":"Causal regressions for unstructured data","venue":null,"work_id":"9a8a43a7-7fe0-4460-b15b-64cc4f12085b","year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.631945Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:a608aca09dd8a7609ccaa0fecf0ee435e7da817368d2fcfa1aa10fdbcd05b221","observation_id":"58c9ac13-0bb7-41a8-8aca-77a9ee31969a","resolution":{"observed_at":"2026-08-07T12:16:19.093833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-07T18:08:01.409989Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-07T12:16:16.728456Z","title":"Secrets of rlhf in large language models part i: Ppo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.728456Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:417fad715ed7d98dab58e5d9059700dc137c3ad3a0770ad539f85a4a70060e4e","observation_id":"c5bc5580-efe2-45b2-973b-4a1e30795853","resolution":{"observed_at":"2026-08-07T12:16:16.728456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09279","last_updated":"2024-10-07T21:24:59Z","snapshot_observed_at":"2026-07-06T18:30:28.421247Z","submitted_at":"2024-06-13T16:17:21Z","title":"Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09279","snapshot_observed_at":"2026-08-07T12:16:16.819602Z","title":"Unpacking dpo and ppo: Disentangling best practices for learning from preference feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.819602Z"},"links":{"cited_paper":"/paper/2406.09279","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:eaf63e60e62710a868e1a98dbd80dcbfabc46d3dc9d7ad01217c8c92d2f79afa","observation_id":"7e660493-93ab-42cd-a656-900de269cc29","resolution":{"observed_at":"2026-08-07T12:16:16.819602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.964626Z","title":"Bias in data-driven artificial intelligence systems—an introductory survey","venue":null,"work_id":"0f69b3e6-e3dd-4145-9d54-c296fd0225a2","year":2020},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:16.913212Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:8f71e1ff4cd03a3e3cc840281627b71917dc10a456d11105aa4d6f61debcae69","observation_id":"4e951b96-3123-48bf-bcd4-574844319aa9","resolution":{"observed_at":"2026-08-07T12:16:19.003112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06601","last_updated":"2023-03-18T20:44:45Z","snapshot_observed_at":"2026-08-09T01:21:57.508175Z","submitted_at":"2022-04-13T18:41:41Z","title":"Causal Confusion and Reward Misidentification in Preference-Based Reward Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06601","snapshot_observed_at":"2026-08-07T12:16:17.017683Z","title":"Causal confusion and reward misidentification in preference-based reward learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.017683Z"},"links":{"cited_paper":"/paper/2204.06601","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:286629993114a21ec25ee9006df8e2ffe03d4554559f53340a7297e49cdcfd6c","observation_id":"3a528559-9b07-4aa3-8710-8ad63f060415","resolution":{"observed_at":"2026-08-07T12:16:17.017683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10162","snapshot_observed_at":"2026-08-07T12:16:17.142465Z","title":"Sycophancy to subterfuge: Investigating reward-tampering in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.142465Z"},"links":{"cited_paper":"/paper/2406.10162","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:70f5e045fdfd5af36984f666fae883b485992558593b23e96c1048426696009a","observation_id":"364f773c-46c3-4693-bd84-54150435f2ee","resolution":{"observed_at":"2026-08-07T12:16:17.142465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07319","last_updated":"2024-02-11T22:40:12Z","snapshot_observed_at":"2026-08-07T04:02:57.297390Z","submitted_at":"2024-02-11T22:40:12Z","title":"ODIN: Disentangled Reward Mitigates Hacking in RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07319","snapshot_observed_at":"2026-08-07T12:16:17.249774Z","title":"Odin: Disentangled reward mitigates hacking in rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.249774Z"},"links":{"cited_paper":"/paper/2402.07319","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:453da80940c8bf6a55533d5981b76cd5cf43e9a75cb0f0064d1952c5d1bc3b93","observation_id":"c7e10994-40b2-4706-903f-2421b967a51a","resolution":{"observed_at":"2026-08-07T12:16:17.249774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09620","last_updated":"2025-05-29T02:21:03Z","snapshot_observed_at":"2026-08-04T12:42:12.769532Z","submitted_at":"2025-01-16T16:00:37Z","title":"Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09620","snapshot_observed_at":"2026-08-07T12:16:17.355112Z","title":"Beyond reward hacking: Causal rewards for large language model alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.355112Z"},"links":{"cited_paper":"/paper/2501.09620","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:e6ee1690a993b0b025b4a8380e78ca09545175885fc99f9b4c02913052ffb57d","observation_id":"9a272143-534e-48a8-8fcd-3a0e9f42ce18","resolution":{"observed_at":"2026-08-07T12:16:17.355112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-10T04:07:56.506438Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T12:16:17.483713Z","title":"Smollm2: When smol goes big – data-centric training of a small language model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.483713Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:f1671acf903e54ecbc5a9c4c679ce99f42d00be53de6faa9edf6ce34053b6b81","observation_id":"fba57f18-16e5-4fdc-8fa1-71201e39de9e","resolution":{"observed_at":"2026-08-07T12:16:17.483713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:17.560917Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.560917Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4d7362d5a5369a441d6d66988f1a99ebb8a058e412051266bc9232c74228d3b7","observation_id":"3fee8457-da0a-4969-a6f0-991d87fcb8a6","resolution":{"observed_at":"2026-08-07T12:16:17.560917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.840075Z","title":"distilbert-base-multilingual-cased-sentiments-student (re- vision 2e33845), 2023","venue":null,"work_id":"ec3371cf-4dfb-4eb4-95d4-8bb4f6f6ea03","year":2023},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.598311Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:98052403aad28afd1d5940cf7056ec0963f2dc9014c6a8c6c299e866f6a9fb65","observation_id":"d4df7dea-5854-4d46-b4d2-bbb80f4e4c9f","resolution":{"observed_at":"2026-08-07T12:16:18.888619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:17.647306Z","title":"A survey on bias and fairness in machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.647306Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:2c12da8ab2f7eebae546985cfcb3a45e77a2649388a02b65132668410e6bb0f4","observation_id":"0056c3d5-8694-46ce-9ea5-cb6f7d039276","resolution":{"observed_at":"2026-08-07T12:16:17.647306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.711261Z","title":"On the adaptive elastic-net with a diverging number of parameters","venue":null,"work_id":"8fbafa9a-2724-47e4-9cd0-3880ab313699","year":2009},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.723474Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:4cbb18dd9290a9744cc245dca93704e6322369cee97993add26245c39755201d","observation_id":"16b0d6ec-d405-4c0e-99e9-3877f97d715a","resolution":{"observed_at":"2026-08-07T12:16:18.762006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.560512Z","title":"Endogeneity in high dimensions","venue":null,"work_id":"2be61d75-d867-4d5b-afa0-8c88c3b45599","year":2014},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.767924Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:950b05e7b0e7ad10e4c4442169f61811724c3aff631a2875a46e2940cf669654","observation_id":"eda638d9-805f-4841-b6d1-17268fd0bc0c","resolution":{"observed_at":"2026-08-07T12:16:18.630931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0250.00050","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:16:18.029388Z","title":"packages","venue":null,"work_id":"2c74f0da-cd31-4847-8398-d81f57040859","year":null},"citing_paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:17.842335Z"},"links":{"citing_paper":"/paper/2506.00152"},"observation_digest":"sha256:78d8a2b5cd559ec2a0fbbe16f470a4432a1463c9c6d8b2ec516f9f708c5d027b","observation_id":"ac285f32-15af-4f0f-9196-dc30448eca56","resolution":{"observed_at":"2026-08-07T12:16:18.120828Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00152","last_updated":"2025-05-30T18:44:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:57:22.037355Z","submitted_at":"2025-05-30T18:44:09Z","title":"Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2506.00152."}