{"as_of":"2026-08-10T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b0307b187a85ae8e8f82caa0b46d115e29512ace2bae13bed6a03f260340427","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:08:24.025435Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T06:07:56.678339Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T06:07:56.725173Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"cited_work":{"arxiv_id":"2506.11702","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11702","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"316ca89f-27a1-4c6c-a497-bcaedece3b05","year":2025},"citing_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T06:07:56.678339Z"},"links":{"cited_paper":"/paper/2506.11702","citing_paper":"/paper/2507.17746"},"observation_digest":"sha256:b1cad364cb7aa0f7f819280568aa1bf9b64844950f9b97acc1cc24d9935fcfa1","observation_id":"8a0c8d06-ac9e-429e-b579-c3010d897804","resolution":{"observed_at":"2026-05-13T06:07:56.727853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11702/citation-record","integrity":"/paper/2506.11702/integrity","json":"/paper/2506.11702/citation-record.json","paper":"/paper/2506.11702"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:22.631282Z","title":"Capturing individual human preferences with reward features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.631282Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:4b8ef0e53e8613f27fed82a33acce1ac2e33bc77193239ec0142afea6c3b8628","observation_id":"fd1a6f39-fad6-4acd-a5d5-36d4b9480030","resolution":{"observed_at":"2026-08-07T04:08:22.631282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.770239Z","title":null,"venue":null,"work_id":"323db410-4253-40b1-9b87-cdfce8eccec6","year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.685509Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:43379ea6a851423743526057f0c80d531dde3041baea4a444b9f4de136cc4b6f","observation_id":"7b00e3ae-83ac-4a6e-acc9-2dc96bb05dec","resolution":{"observed_at":"2026-08-07T04:08:24.867958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:22.746721Z","title":"F., Leike, J., Brown, T., Martic, M., Legg, S., and Amodei, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.746721Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:438728f9b9c7e2de4f34a6e057e785e0259e61005be8929bf0f3600c60584515","observation_id":"ffb9cda2-e3fd-44f3-8acc-ea522c25303a","resolution":{"observed_at":"2026-08-07T04:08:22.746721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10271","last_updated":"2024-06-04T14:34:38Z","snapshot_observed_at":"2026-08-08T15:23:39.679749Z","submitted_at":"2024-04-16T03:59:33Z","title":"Social Choice Should Guide AI Alignment in Dealing with Diverse Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10271","snapshot_observed_at":"2026-08-07T04:08:22.822573Z","title":"H., Jacobs, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.822573Z"},"links":{"cited_paper":"/paper/2404.10271","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:aac148e6a79c96f2f607ff1177a26950f08cecec9d90bfc6ed25e70ab83529b1","observation_id":"7292b80e-0ade-4f5b-a99e-d3c212b35550","resolution":{"observed_at":"2026-08-07T04:08:22.822573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14115","last_updated":"2024-01-10T16:11:32Z","snapshot_observed_at":"2026-07-06T16:51:40.320710Z","submitted_at":"2023-11-23T17:20:36Z","title":"A density estimation perspective on learning from pairwise human preferences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14115","snapshot_observed_at":"2026-08-07T04:08:22.959105Z","title":"D., Castro, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:22.959105Z"},"links":{"cited_paper":"/paper/2311.14115","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:313db49ac8431bc825ecf3595bd4a3f32366df83f4c9caa0c8a14fe3cd69aed6","observation_id":"6394af7c-b335-4c7c-ab7a-a383bf119ab1","resolution":{"observed_at":"2026-08-07T04:08:22.959105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00495","last_updated":"2024-03-30T23:28:05Z","snapshot_observed_at":"2026-07-06T17:53:31.221833Z","submitted_at":"2024-03-30T23:28:05Z","title":"Configurable Safety Tuning of Language Models with Synthetic Preference Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00495","snapshot_observed_at":"2026-08-07T04:08:23.120937Z","title":"Configurable safety tuning of language models with synthetic preference data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.120937Z"},"links":{"cited_paper":"/paper/2404.00495","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:1f969a3a3f4adf70a9ca8609975b8d37dfcd13e04360212304a618a97ad6cb8f","observation_id":"86609ba3-3c2f-4935-abe2-e03dc5dfaf64","resolution":{"observed_at":"2026-08-07T04:08:23.120937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13011","last_updated":"2024-03-14T18:07:10Z","snapshot_observed_at":"2026-08-08T21:55:02.376282Z","submitted_at":"2023-10-17T01:31:59Z","title":"Compositional preference models for aligning LMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13011","snapshot_observed_at":"2026-08-07T04:08:23.227133Z","title":"Compositional preference models for aligning lms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.227133Z"},"links":{"cited_paper":"/paper/2310.13011","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:e675d9f3c0080c3e199e24837f7fdd0445073edf04dec0571a3b4921ea4a0def","observation_id":"1134de0f-dba1-486f-b487-568bd8007fec","resolution":{"observed_at":"2026-08-07T04:08:23.227133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T04:08:23.386571Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.386571Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:e39f423320f6cc026adcd66094831fa96a22305ba5e92ab0648c1f6569eee9a1","observation_id":"90862026-c584-4346-b76d-f213a5dba549","resolution":{"observed_at":"2026-08-07T04:08:23.386571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:08:23.505047Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.505047Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:83c4223ddd47e12ee74103a042c92f4879271584523686b5359bec1bc30f9eee","observation_id":"5c98fe95-afba-4482-a43e-fc947cace56c","resolution":{"observed_at":"2026-08-07T04:08:23.505047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:23.582086Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., Chen, W., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.582086Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:6624fb39741fb8215f8a4a6237d25062c0ab7b1d651ee02cf3fd1ee7f8cb1940","observation_id":"934cce3c-b197-41e3-8282-22c1b2a20897","resolution":{"observed_at":"2026-08-07T04:08:23.582086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05133","last_updated":"2024-12-09T04:21:08Z","snapshot_observed_at":"2026-08-06T13:42:00.057517Z","submitted_at":"2024-02-06T04:18:58Z","title":"Personalized Language Modeling from Personalized Human Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05133","snapshot_observed_at":"2026-08-07T04:08:23.633018Z","title":"C., and Leqi, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.633018Z"},"links":{"cited_paper":"/paper/2402.05133","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:64e068376c9995851f306939db3d2ad20d42656ee7165a9eaecbfe01e2467aac","observation_id":"38151b5c-effe-4c85-a42b-0fce1a8e4579","resolution":{"observed_at":"2026-08-07T04:08:23.633018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.600818Z","title":"Openai o3 mini system card","venue":null,"work_id":"e908b8b8-6be4-4af2-98e4-7b1cf5ef831a","year":2025},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.689062Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:ecde5ff8d135517264203462730ed793cb7bc631ebd69573a48955eaf6e35389","observation_id":"57a1a22d-4801-4146-b073-0bf13b4fcd93","resolution":{"observed_at":"2026-08-07T04:08:24.661153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:23.746284Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.746284Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:00f1d69b5c6cdfaeef756c40ad7587d86a9f63c5697f3a3634b5b72f58004a7e","observation_id":"621c733d-87c0-4a57-b565-e07379c42986","resolution":{"observed_at":"2026-08-07T04:08:23.746284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-08-09T20:26:15.885759Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-07T04:08:23.797237Z","title":"Personalizing reinforcement learning from human feedback with variational preference learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.797237Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:a60c99d170947090b2e0599adbf074b8263ff5621143af56f27d1dc69c7c3598","observation_id":"8d1d615b-98dc-469c-a8cf-fc480c450fee","resolution":{"observed_at":"2026-08-07T04:08:23.797237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.458798Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":"1adc21f8-57c5-4327-85d9-731a00ba9610","year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.835248Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:dcb7b77606fc5ef8d2b26f858c1fa5d7bce031ed38204d9fbafc7c0600e4b763","observation_id":"0c5dfe93-a7e5-4a03-b9fa-e891551e0936","resolution":{"observed_at":"2026-08-07T04:08:24.539135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.316967Z","title":"Self-supervised visual preference alignment","venue":null,"work_id":"b9aecfe3-6d52-4ff0-ab9a-c99dc0d2d933","year":2024},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.896721Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:f74ab4b49f72a55596a8f303e58223e8fed71f6ccf4bf0355543afe8c9f55b43","observation_id":"fd46a228-ffb0-4563-9dbb-7d12458f2865","resolution":{"observed_at":"2026-08-07T04:08:24.372980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T04:08:23.959593Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:23.959593Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:c0f0dff0103702f2bd3ed8a1d59268eb9596c5ea4891b76041058fbc9a9e6be5","observation_id":"cf0d61f7-e7f2-4304-a64e-5c7d477065ec","resolution":{"observed_at":"2026-08-07T04:08:23.959593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:08:24.025435Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:24.025435Z"},"links":{"citing_paper":"/paper/2506.11702"},"observation_digest":"sha256:bd2ce76872dbe765518c826d84d832e31d0fc5cbe7566d08a160a4dcb2c50e57","observation_id":"3ba555ae-30fa-448c-a006-99f28a4c1a5a","resolution":{"observed_at":"2026-08-07T04:08:24.025435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11702","last_updated":"2025-06-13T12:17:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T15:24:30.115082Z","submitted_at":"2025-06-13T12:17:38Z","title":"Configurable Preference Tuning with Rubric-Guided Synthetic Data"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2506.11702."}