{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:RG7NW77YO3ZSOUDED4FVTQNKQE","short_pith_number":"pith:RG7NW77Y","schema_version":"1.0","canonical_sha256":"89bedb7ff876f32750641f0b59c1aa8123e385b3502158421915aeaed865d503","source":{"kind":"arxiv","id":"2407.17387","version":1},"attestation_state":"computed","paper":{"title":"PERSONA: A Reproducible Testbed for Pluralistic Alignment","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Chelsea Finn, Jan-Philipp Fr\\\"anken, Louis Castricato, Nathan Lile, Rafael Rafailov","submitted_at":"2024-07-24T16:11:39Z","abstract_excerpt":"The rapid advancement of language models (LMs) necessitates robust alignment with diverse user values. However, current preference optimization approaches often fail to capture the plurality of user opinions, instead reinforcing majority viewpoints and marginalizing minority perspectives. We introduce PERSONA, a reproducible test bed designed to evaluate and improve pluralistic alignment of LMs. We procedurally generate diverse user profiles from US census data, resulting in 1,586 synthetic personas with varied demographic and idiosyncratic attributes. We then generate a large-scale evaluation"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2407.17387","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2024-07-24T16:11:39Z","cross_cats_sorted":[],"title_canon_sha256":"cbacb51891b87f48cea45df0ff1e53c40aac943327f859f70e390e479f014cf9","abstract_canon_sha256":"3d0df61f5fa06640af36a2f5c2c460fdff9e711a3c4d2feff4b4c64bdd37d804"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:48:07.898436Z","signature_b64":"E1s9sa8uWRaJ2KNKy5mHL1lSz5mQ7fYPUvgcZUpGgkWCPHkOZVP0DkdN47Ek5Qsuq80xCzHtVpWEagc2r01aCQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"89bedb7ff876f32750641f0b59c1aa8123e385b3502158421915aeaed865d503","last_reissued_at":"2026-07-05T08:48:07.898017Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:48:07.898017Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"PERSONA: A Reproducible Testbed for Pluralistic Alignment","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Chelsea Finn, Jan-Philipp Fr\\\"anken, Louis Castricato, Nathan Lile, Rafael Rafailov","submitted_at":"2024-07-24T16:11:39Z","abstract_excerpt":"The rapid advancement of language models (LMs) necessitates robust alignment with diverse user values. However, current preference optimization approaches often fail to capture the plurality of user opinions, instead reinforcing majority viewpoints and marginalizing minority perspectives. We introduce PERSONA, a reproducible test bed designed to evaluate and improve pluralistic alignment of LMs. We procedurally generate diverse user profiles from US census data, resulting in 1,586 synthetic personas with varied demographic and idiosyncratic attributes. We then generate a large-scale evaluation"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2407.17387","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2407.17387/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2407.17387","created_at":"2026-07-05T08:48:07.898073+00:00"},{"alias_kind":"arxiv_version","alias_value":"2407.17387v1","created_at":"2026-07-05T08:48:07.898073+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2407.17387","created_at":"2026-07-05T08:48:07.898073+00:00"},{"alias_kind":"pith_short_12","alias_value":"RG7NW77YO3ZS","created_at":"2026-07-05T08:48:07.898073+00:00"},{"alias_kind":"pith_short_16","alias_value":"RG7NW77YO3ZSOUDE","created_at":"2026-07-05T08:48:07.898073+00:00"},{"alias_kind":"pith_short_8","alias_value":"RG7NW77Y","created_at":"2026-07-05T08:48:07.898073+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":5,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.27578","citing_title":"PEBS: Per-rater Empirical-Bayes Shrinkage for RLHF Reward-Model Calibration","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2606.29793","citing_title":"Fund2Persona: A Framework for Building and Refining Financial Advisor Personas from Fund Disclosure Data","ref_index":15,"is_internal_anchor":false},{"citing_arxiv_id":"2606.29793","citing_title":"Fund2Persona: A Framework for Building and Refining Financial Advisor Personas from Fund Disclosure Data","ref_index":15,"is_internal_anchor":false},{"citing_arxiv_id":"2412.08812","citing_title":"Test-Time Alignment via Hypothesis Reweighting","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2605.10310","citing_title":"Positive Alignment: Artificial Intelligence for Human Flourishing","ref_index":26,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE","json":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE.json","graph_json":"https://pith.science/api/pith-number/RG7NW77YO3ZSOUDED4FVTQNKQE/graph.json","events_json":"https://pith.science/api/pith-number/RG7NW77YO3ZSOUDED4FVTQNKQE/events.json","paper":"https://pith.science/paper/RG7NW77Y"},"agent_actions":{"view_html":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE","download_json":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE.json","view_paper":"https://pith.science/paper/RG7NW77Y","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2407.17387&json=true","fetch_graph":"https://pith.science/api/pith-number/RG7NW77YO3ZSOUDED4FVTQNKQE/graph.json","fetch_events":"https://pith.science/api/pith-number/RG7NW77YO3ZSOUDED4FVTQNKQE/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE/action/timestamp_anchor","attest_storage":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE/action/storage_attestation","attest_author":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE/action/author_attestation","sign_citation":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE/action/citation_signature","submit_replication":"https://pith.science/pith/RG7NW77YO3ZSOUDED4FVTQNKQE/action/replication_record"}},"created_at":"2026-07-05T08:48:07.898073+00:00","updated_at":"2026-07-05T08:48:07.898073+00:00"}