{"as_of":"2026-08-15T04:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9405d7ec96cd902e6aced62b5c2077eb440ae773069fa21b3983828eae48209e","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:59:10.184366Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:44:47.323075Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:44:51.507749Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"cited_work":{"arxiv_id":"2501.03486","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03486","snapshot_observed_at":"2026-08-07T14:44:51.507749Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","venue":"cs.LG","work_id":"55fed41d-2de7-4bc3-abbb-64dea42523c8","year":2025},"citing_paper":{"arxiv_id":"2505.17735","last_updated":"2025-07-18T07:34:40Z","snapshot_observed_at":"2026-08-12T21:31:18.524742Z","submitted_at":"2025-05-23T10:56:06Z","title":"SafeAgent: Safeguarding LLM Agents via an Automated Risk Simulator","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:47.323075Z"},"links":{"cited_paper":"/paper/2501.03486","citing_paper":"/paper/2505.17735"},"observation_digest":"sha256:ea3624e7f2ccea94e17a25ed765f4fd93b1b707d58e9923034bf81d711d85d25","observation_id":"476f0a0c-491b-4a7c-9159-8d27bfe9a932","resolution":{"observed_at":"2026-08-07T14:44:51.565391Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.03486/citation-record","integrity":"/paper/2501.03486/integrity","json":"/paper/2501.03486/citation-record.json","paper":"/paper/2501.03486"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:11.092419Z","title":"Secrets of rlhf in large language models part ii: Reward modeling","venue":null,"work_id":"80be8034-7b15-4685-93e0-40454ea970ba","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.926127Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:c2954215c5156d06c5f29e0c6edd081e0338bd3d32acf4d695a1a396feab3b05","observation_id":"f3dbc39f-d98b-4946-8524-69f0e91ce6c1","resolution":{"observed_at":"2026-08-10T21:59:11.097394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:11.079443Z","title":"A survey of reinforcement learning from human feedback","venue":null,"work_id":"d3ce7061-db04-4a11-81c9-efb1c664952a","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.930869Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:916f53e9a4d0e6eb1eb878b1dfa3db5791c4b216ef81f5cdd381563bef599060","observation_id":"e7bed5ab-415b-4c58-92e4-1b5364fee949","resolution":{"observed_at":"2026-08-10T21:59:11.083952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:11.066183Z","title":"More RLHF, More Trust? On The Impact of Human Preference Alignment On Language Model Trustworthiness","venue":null,"work_id":"dbf80e36-0475-4c2b-b485-1e5d8d303056","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.934994Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:8b74a2203902094cf452a913b297fc4034408e3580e50e82554efe75d36f84b6","observation_id":"6116827e-cf89-4023-b118-7c0d6f88fa36","resolution":{"observed_at":"2026-08-10T21:59:11.070875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:11.051603Z","title":"Safe rlhf: Safe reinforcement learning from human feedback","venue":null,"work_id":"3af34e90-b42e-4bf2-a3a3-bfb6d92749b8","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.939104Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:708393e9699bed745cd741caaee0b35cbb5d7d83423595c90d25e9b0c2268b00","observation_id":"18713587-ed6e-41fc-8679-dd676ae9625e","resolution":{"observed_at":"2026-08-10T21:59:11.057304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.907547Z","title":"Principled Reinforcement Learning with Human Feedback from Pairwise orK-wise Comparisons","venue":null,"work_id":"dae43bdd-b605-4e19-bb9a-c491370b61cc","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.943106Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:cdbf69acb2ce2328ad7959220e4ebe2902f415695f4470d78f3676f84355edd3","observation_id":"a7166d65-becc-46a7-8972-7f215e8d80c2","resolution":{"observed_at":"2026-08-10T21:59:10.911856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.896539Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":"419f484b-6252-481d-b878-434fede6319e","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.947186Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:bbf58c2a4920ef65d230a51439890b33734143cfc7c4edb9ba6bfbf52fac06dc","observation_id":"29f680c8-bac2-490b-9edb-a496cfe2ec85","resolution":{"observed_at":"2026-08-10T21:59:10.900351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.886043Z","title":"Fine-Tuning Language Models from Human Preferences","venue":null,"work_id":"3d61a24a-1a8b-46ce-bdf7-e39344e33836","year":2019},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.952094Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:dc378e5475bfed15bc75c4e6fceb908e94776f69c0aa581f2c297a139e4f09c5","observation_id":"a3f8eccf-19a6-40a1-9468-0771028071ab","resolution":{"observed_at":"2026-08-10T21:59:10.889980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.874597Z","title":"Open problems and fundamental limitations of reinforcement learning from human feedback","venue":null,"work_id":"04d46d09-c4c4-49e9-bcb4-8af2b475bc9e","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.955925Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:3f866dce21d2d72a6b2aa18dda33b61983c42d264cee52ba94195e09a195cb5e","observation_id":"391c5cb3-d8b5-49ac-b31f-1a8abcb5dcb4","resolution":{"observed_at":"2026-08-10T21:59:10.878483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.863454Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"f46294ae-ec16-4e7f-8edc-1136db40ad24","year":2022},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.959893Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:d59c8b2816426f931f94dd42f35c9fd3162d887f685fca399bd7b8c2b5810702","observation_id":"faf43128-af30-4199-8203-5c34d79c08ed","resolution":{"observed_at":"2026-08-10T21:59:10.867386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.851175Z","title":"Black-Box Prompt Learning for Pre-trained Language Models","venue":null,"work_id":"9e7e9bd9-80a7-4313-8cbb-45f6512df282","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.964042Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:07f12003ea61b030f2bfe6c31f8a282a48bbcdf01daad80aa98fe3ad0c9f09b0","observation_id":"451a0237-393a-411f-b747-9d97cdec58a4","resolution":{"observed_at":"2026-08-10T21:59:10.855840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.837487Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","venue":null,"work_id":"1eaf1886-d876-4aac-8d6b-9e9e068e5d8a","year":null},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.968387Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:45734e951360c3a1137ca4058965e8df0c97aabb3c704a9661a2bca0d8d0bb56","observation_id":"e44f31cb-560f-413d-9c4e-1c080c84cfb7","resolution":{"observed_at":"2026-08-10T21:59:10.841869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.825285Z","title":"Prompt Optimization with Human Feedback","venue":null,"work_id":"bfeeb801-80db-4021-8cf8-74409acc8669","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.972243Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:3ed55d1db15bcdab63721dba32e4a13f14f0b16e68c27ab82ff78c3890146be4","observation_id":"de5a6c1d-ba17-4318-ab0f-05d7be0252b3","resolution":{"observed_at":"2026-08-10T21:59:10.829562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.813486Z","title":"Learning overparameterized neural networks via stochastic gradient descent on structured data","venue":null,"work_id":"8aa8cb47-dcba-45d5-9b25-1c257147a111","year":2018},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.976283Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:0abdab4942070c07a4e270551fa6c7c234a45ff071d61a6a6e7c531d302098ed","observation_id":"0b766e39-0900-4563-9c1e-d51fb9106020","resolution":{"observed_at":"2026-08-10T21:59:10.817448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.802181Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","venue":null,"work_id":"eb4d70d3-e4b7-4805-a1c1-919650ae74bd","year":2021},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.979957Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:540ad0f472993072efadccb8518dab6c082a7c861bc33206b8529ec529cac548","observation_id":"fcfe79d1-167c-4dde-9fa7-18861793afd6","resolution":{"observed_at":"2026-08-10T21:59:10.806005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.789077Z","title":"PRewrite: Prompt Rewriting with Reinforcement Learning","venue":null,"work_id":"5438b2e5-91d7-4f38-aa86-386da5cada6b","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.983750Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:cbcb1715b3b1e794b2645903681e520981a3e52a3d47b5cc9e91c4ad5695c863","observation_id":"acdeefd7-43be-4106-81c9-fddbc78f261d","resolution":{"observed_at":"2026-08-10T21:59:10.793458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.777482Z","title":"PromptAgent: Strategic planning with language models enables expert-level prompt optimization","venue":null,"work_id":"bbd798fb-a55f-44b4-85fa-0364b2eca250","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.987939Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:9b4d994504e5f425f0a8ffa5df78e1e7d9f6422825e0119ced4f6999e7b61804","observation_id":"56b98ff1-d3ff-4bfc-8255-9e838e19fab7","resolution":{"observed_at":"2026-08-10T21:59:10.781554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.765295Z","title":"Alpacafarm: A simulation framework for methods that learn from human feedback","venue":null,"work_id":"eba92360-22ca-4eb3-9a05-3f10d6839286","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.991714Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:ff1fd90fa83765f558f6aad72200d6d782d19588ed3e0f89dde6baef3ba5bf0b","observation_id":"fcb8f4c1-3cfe-4ea0-8e9f-cd5ffca179f3","resolution":{"observed_at":"2026-08-10T21:59:10.769338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.752681Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":"781760cc-2e6e-4f06-867a-361bdd2082f6","year":2019},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.995295Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:407780e1873f01e665c29b44f9867c7b42804b018d10398b8fcce7f104ec3a9f","observation_id":"562926ee-1217-4ae1-a667-cfaad434bce6","resolution":{"observed_at":"2026-08-10T21:59:10.757111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.740734Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","venue":null,"work_id":"34e0ae38-b2ad-4d86-9dd9-b5853917c2f6","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:09.999074Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:3e24628f8e8d12069cd3eb0474754d24f9b1309ec6553223883f95d7a4a5a14a","observation_id":"d18022bb-15a5-4864-aec3-69662755b378","resolution":{"observed_at":"2026-08-10T21:59:10.744768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.729526Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"1ce68550-d825-446d-b834-37b42da98bd9","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.002759Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:5b833e542887a51d0af8f40620defca496279efd6798b1a38de7b70442d007c5","observation_id":"7becd67c-580b-4559-a3da-63f2671a61e4","resolution":{"observed_at":"2026-08-10T21:59:10.733338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.717513Z","title":"Slic-hf: Sequence likelihood calibration with human feedback","venue":null,"work_id":"3bf7ce70-e076-423a-a7b2-33216a4ab187","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.006725Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:9fa150bd9337756b1e040576b04255b3f3295d3dc7d914ed1294e22170b97224","observation_id":"276465e7-0c69-41ef-8326-2cf77d19cd43","resolution":{"observed_at":"2026-08-10T21:59:10.721599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.706115Z","title":"Direct Preference Optimization with an Offset","venue":null,"work_id":"2b4f9fa5-ba7b-417b-84b1-a7444975349f","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.011292Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:fbad3a61af4f71a173c7df10ff509fc52e54d4b06030753c045c46fe67db3a7d","observation_id":"312fa8a8-7906-4cf3-94f6-60cd8e4841f8","resolution":{"observed_at":"2026-08-10T21:59:10.710610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.694820Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":"07920a60-7525-4225-b66d-337616fadbf5","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.018598Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:27f68c6d38d9c556b706970e8eeabf3a509700c925ce2f8e0db663f22cba0f55","observation_id":"bda6fc92-a6e3-4b8e-801f-0cc62d25afd6","resolution":{"observed_at":"2026-08-10T21:59:10.698615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.682824Z","title":"Mixed Preference Optimization: Reinforcement Learning with Data Selection and Better Reference Model","venue":null,"work_id":"0a51187c-18e5-4369-8591-fc42c7552ca5","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.022634Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:6f2411d5d3a38e27bfc34206d6eca064ee0c5a221041a202d0eaefd352c427c5","observation_id":"fd32cd9f-1ff1-4766-950d-7bc08cf6402f","resolution":{"observed_at":"2026-08-10T21:59:10.687129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.671694Z","title":"LiPO: Listwise Preference Optimization through Learning-to-Rank","venue":null,"work_id":"80abb66a-235a-4932-974c-317922ccc89c","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.026728Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:c333354dffcbb72faf7fcb2fcf923c26a22168ced2c73d625e2e33a4c6511924","observation_id":"ef2e944e-cf69-4612-bbce-a07125d2fd51","resolution":{"observed_at":"2026-08-10T21:59:10.675594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.659811Z","title":"Filtered Direct Preference Optimization","venue":null,"work_id":"d4eeffe3-a1a4-4710-8612-35382f9768db","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.030655Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:ef321b5398ecc13719e57d4e97737a5ddda66f0df1655a2ac0c05fb5455505cc","observation_id":"acccd9f2-e803-4e7d-a598-21b33f1a4190","resolution":{"observed_at":"2026-08-10T21:59:10.664246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.647768Z","title":"Generalized Preference Optimization: A Unified Approach to Offline Alignment","venue":null,"work_id":"a2e5908d-3dd3-4315-bd1d-bd380ae26916","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.034286Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:f4f18a5e8e2531129765377ccaca9fb5c74fa000bccfbe1098a2f9b665ffc54b","observation_id":"9f50da3e-b0af-4bf3-b854-06da05888027","resolution":{"observed_at":"2026-08-10T21:59:10.651784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.634769Z","title":"Beyond reverse kl: Generalizing direct preference optimization with diverse divergence constraints","venue":null,"work_id":"e3697708-38d5-4bbf-a896-e8834303823c","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.038257Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:0006fc82f69e88fb3a51f019f43bf83d0c07eeeb0ed7df960b1ae276ab1b52b1","observation_id":"79c9d017-81a4-49ba-9a5b-e82bd0174600","resolution":{"observed_at":"2026-08-10T21:59:10.639005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.622184Z","title":"Efficient Exploration for LLMs","venue":null,"work_id":"c69c76be-f543-425a-b220-fd938ffdf9f0","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.042508Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:97ebb61293d7bd52d869f255d315236fb25dca91c996dbd8cd5bc9874a90a58e","observation_id":"831659da-f0f9-432b-a8c9-bfb3568592b4","resolution":{"observed_at":"2026-08-10T21:59:10.626604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-08-13T04:59:53.332269Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-10T21:59:10.046964Z","title":"ORPO: Monolithic Preference Optimization without Reference Model; 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.046964Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:3a2f3ed7d24c34508a2f9ce9249132cf8aee75e29f90ee68d308750823cdfc91","observation_id":"6cb06d3e-57b7-46aa-9b64-7996b7e80d80","resolution":{"observed_at":"2026-08-10T21:59:10.046964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11870","last_updated":"2025-07-14T04:15:46Z","snapshot_observed_at":"2026-08-13T00:03:59.068590Z","submitted_at":"2024-05-20T08:23:28Z","title":"Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11870","snapshot_observed_at":"2026-08-10T21:59:10.051147Z","title":"Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process; 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.051147Z"},"links":{"cited_paper":"/paper/2405.11870","citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:dd12efa9330c7f87a10557cb87432c56d363c60dfe4973b0c74e12e124c3ec13","observation_id":"71467c5b-ca64-498d-ad56-06f457e4537a","resolution":{"observed_at":"2026-08-10T21:59:10.051147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.608109Z","title":"Toward Human Readable Prompt Tuning: Kubrick’s The Shining is a good movie, and a good prompt too? In: Proc","venue":null,"work_id":"19c2c044-38da-4997-9a73-a5026f49072a","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.055788Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:b3f06c62f7fa9df69b2b71a919502a98910d4091d7875ccedd78bd4576f481b3","observation_id":"64b6647a-c6a1-451d-a077-a3130b34f3b8","resolution":{"observed_at":"2026-08-10T21:59:10.613355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.594164Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","venue":null,"work_id":"fdf6ecb0-7c61-4e28-96df-6d7f9a7b44bf","year":2021},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.060150Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:5db657f10724819a22d260bb520ee80193d5d9374f5808b17f846155b5458c6a","observation_id":"d5c25949-cf2d-42fb-810d-944cd447bffe","resolution":{"observed_at":"2026-08-10T21:59:10.599248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.582372Z","title":"Factual Probing Is [MASK]: Learning vs","venue":null,"work_id":"2ab13c94-56d0-4031-8ed4-169bc404573b","year":2021},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.064526Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:8525a0b5881c672f012e5cd5d6a84b96d1e96e291684bfb06ca069973d0410c4","observation_id":"d345a886-0366-4586-b950-576a41d19a03","resolution":{"observed_at":"2026-08-10T21:59:10.586236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.571171Z","title":"Clip-Tuning: Towards Derivative-free Prompt Learning with a Mixture of Rewards","venue":null,"work_id":"daa0f490-7624-4742-a74d-1bad04a011c0","year":2022},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.069197Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:3ae0956768ec0f3108dba09a959c5ba554cafc3b96a5eae003e015f59967e006","observation_id":"c0d3c806-2aca-48ac-94a8-b8ca6bc2bdf0","resolution":{"observed_at":"2026-08-10T21:59:10.575203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.559462Z","title":"Black-box tuning for language-model-as-a-service","venue":null,"work_id":"6480b26c-79b4-4f35-8311-c5d306ed7598","year":2022},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.073624Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:56f3d325851b80df833e0e557a89b1faa2553193ff2c64f3b021ac138e35e38b","observation_id":"3622ab08-5ec3-4f66-bfcc-072b8be0ad4f","resolution":{"observed_at":"2026-08-10T21:59:10.563622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.548516Z","title":"BBTv2: Pure Black-Box Optimization Can Be Comparable to Gradient Descent for Few-Shot Learning","venue":null,"work_id":"e4e32966-3229-4dd0-9bc1-e2932498dd11","year":2022},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.078619Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:597b93b8d5ab3653db0096cf25e7e9b24c10f860a0410e1f1899ecff0fd76c8c","observation_id":"46e78e99-c8c2-4041-879d-de6b1e959055","resolution":{"observed_at":"2026-08-10T21:59:10.552265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.537089Z","title":"MultiPrompter: Cooperative Prompt Optimization with Multi-Agent Reinforcement Learning","venue":null,"work_id":"f54519df-4d85-42cb-9dc2-ac58ae17dc59","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.084147Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:89f6fd84aa8c576055b9215fcff058441483bbd10e7d0adfd5edc2ddebe8514d","observation_id":"e68c2763-ce7e-42e5-a131-0e2e0a852c4a","resolution":{"observed_at":"2026-08-10T21:59:10.541189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.524936Z","title":"Curiosity-driven red-teaming for large language models","venue":null,"work_id":"9a4523e7-8503-4af2-926d-d67c1156a209","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.088714Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:bc5e0c29d7b1977d186e2d9d4603d2e5a7368f0f9e802b7239e9828ffc5f628c","observation_id":"a5f0095c-972c-4273-9dc7-ad532465c38c","resolution":{"observed_at":"2026-08-10T21:59:10.529081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-08-14T22:08:45.647927Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-10T21:59:10.092988Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.092988Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:808c4e9c2800aaada1a36db3dfcb9afc9af56b4df8482094878f8ca4fe69dc25","observation_id":"b092b334-e32b-462b-b4cc-09b113439480","resolution":{"observed_at":"2026-08-10T21:59:10.092988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.513510Z","title":"Gradient-based language model red teaming","venue":null,"work_id":"7474349b-63fd-4126-83b8-8e767f35503a","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.099042Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:4d7e22b79c7532c301c8b0a35424d13ce5ed05cd8055e5f71947fff660448726","observation_id":"6dcfc53a-4602-4135-942d-6df245602b2a","resolution":{"observed_at":"2026-08-10T21:59:10.517438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.500941Z","title":"Learning diverse attacks on large language models for robust red-teaming and safety tuning","venue":null,"work_id":"b76e6312-5c8a-4ce0-aa27-3c02cde821ae","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.104099Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:2690d9b75f835987664fa42cb0e22b499b535f42714793e001703cee89773c25","observation_id":"f4541b2d-78e4-4bec-8e95-1c95d142d157","resolution":{"observed_at":"2026-08-10T21:59:10.505313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.486395Z","title":"LIAR: Leveraging Alignment (Best-of-N) to Jailbreak LLMs in Seconds","venue":null,"work_id":"7d50505a-04e5-4f9d-b633-2864a080eef4","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.113113Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:6271af49a03cefdb686f49d320fb4e5e8c312d2f23346e2f22a98c0240f86ba7","observation_id":"82a672a9-7e88-4cc4-bfab-1f566211638a","resolution":{"observed_at":"2026-08-10T21:59:10.490978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.471994Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":"115547c1-04f7-4172-aefe-ea2e9b34951d","year":1952},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.117793Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:8ff9008e24f019ef1f46a158be3faa04f98f3e64e92daa70d96b7003ec22144a","observation_id":"c3661996-7ddb-4a79-9589-8da45f9648bc","resolution":{"observed_at":"2026-08-10T21:59:10.477247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.459826Z","title":"Large Language Models Are Human-Level Prompt Engineers","venue":null,"work_id":"c0512132-6f85-4d7e-94c1-9e1123c70641","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.123021Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:12da0e45793f0e2ac3b5a7d521ad27658ed8caa0f1a7617c017c5a39d8e4c5de","observation_id":"40faa462-52eb-4e62-8fe3-ec3fc011815f","resolution":{"observed_at":"2026-08-10T21:59:10.463915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.446671Z","title":"Advantage-weighted regression: Simple and scalable off-policy reinforcement learning","venue":null,"work_id":"9381ee9e-0ec8-4545-983e-1027c53350e7","year":2019},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.126915Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:109775ee5cf40daae1971bc74849e069c487f428ef7c0186c5ed73965e00c84e","observation_id":"af3e1967-17e4-4c35-9a13-0fec56182b5c","resolution":{"observed_at":"2026-08-10T21:59:10.451922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.434095Z","title":"Reinforcement learning by reward-weighted regression for operational space control","venue":null,"work_id":"bb99d525-b11d-4b94-a136-8a4c910aeee1","year":null},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.131657Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:196267288062cb70e6023eebafeba36013643ee3f42656717b511d02dfb1886c","observation_id":"8372c7cc-3d3d-4eb5-8ad2-29ac7363d3c6","resolution":{"observed_at":"2026-08-10T21:59:10.438995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.421285Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"682958ec-294a-40e8-a339-76ecc1d0f772","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.136433Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:5f68e664e57bd27a782e46723fc6acf66d541dd220009efe309378023c5dda4e","observation_id":"014d6aa8-19ef-41d3-9101-89fce8150344","resolution":{"observed_at":"2026-08-10T21:59:10.425775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.406765Z","title":"ULTRAFEEDBACK: Boosting Language Models with Scaled AI Feedback","venue":null,"work_id":"114a3a61-4de8-40bb-8cc4-6a166f186d37","year":2024},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.143601Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:a8eaa834db4b15255aad06e6443030c1575b104c8f782a8d98d5d727c37823bc","observation_id":"13b2585d-fd8d-41ca-94d8-326791ea42ef","resolution":{"observed_at":"2026-08-10T21:59:10.411813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.392928Z","title":"Helpsteer: Multi-attribute helpfulness dataset for steerlm","venue":null,"work_id":"f3bd0db7-0ec2-4153-a49c-1d1bfe28018b","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.148222Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:029de42f07798c10a9b3cac112443d205487142d82de40571898c7fd102000db","observation_id":"5370850f-8f2f-4e0c-b091-5a7c8ecdd6c0","resolution":{"observed_at":"2026-08-10T21:59:10.398533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.375973Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4","venue":null,"work_id":"c4f678f7-0b18-45f3-9db4-12aa599750af","year":2023},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.153753Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:ab1d287cec45134f2a193fc4fe9d4b9b0a32fd078140b6b44a9fe38ebc1c9a5b","observation_id":"5dc24dbd-7e44-4abe-b802-6d683215fcbc","resolution":{"observed_at":"2026-08-10T21:59:10.380870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.361346Z","title":null,"venue":null,"work_id":"3cfec3d1-c36e-4322-8655-48e8dc96ca87","year":2008},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.159560Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:7183b449ea9818df3ad6deb6f9cacac4c2386f6d0a29a5f72caa1931c8bb1e94","observation_id":"d3f032c6-9ece-4a74-b5af-1af73d25d73e","resolution":{"observed_at":"2026-08-10T21:59:10.365726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.344462Z","title":"While this aspect certainly played a crucial role, it oversimplifies the broader economic and structural issues","venue":null,"work_id":"36244c27-5d73-451d-9f8c-179622cb65aa","year":2008},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.165126Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:85e9921ca959ed1f7631c31e5aa64e3634df0f4d34783682075c1bb219fc2662","observation_id":"444e9694-5020-48a5-bc32-58c3ba765577","resolution":{"observed_at":"2026-08-10T21:59:10.349852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.326784Z","title":"These tools allowed financial institutions to shift risk off their balance sheets and increase leverage, ultimately contributing to instability","venue":null,"work_id":"c44567cc-b532-4bbd-9c37-86c4b62d2105","year":2008},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.170041Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:65c366396398c44d90f4039e18cded376cc2745e9868841692d9be65b6fce684","observation_id":"e67b434d-cc16-47dc-8e30-aac1facce29e","resolution":{"observed_at":"2026-08-10T21:59:10.331968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.308169Z","title":"Birdhouses and Animal Habitats:Smaller bottles can serve as habitats for birds or insects","venue":null,"work_id":"7785d1ef-b5b3-4935-8077-b9c24d7e9383","year":null},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.175572Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:7c06a6a979f0f1ae8ea0d25a9b1edecdd8d6139bbced6547d5036c141eeedaf5","observation_id":"24e09e9e-8087-4c34-ab23-dada236ba7d0","resolution":{"observed_at":"2026-08-10T21:59:10.314340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.289569Z","title":"Garden Tools: Convert old bottles into garden markers, plant markers, or simple tools like a mini watering sprayer","venue":null,"work_id":"d940eb9f-d040-4cd8-ae30-075178d7b135","year":null},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.180155Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:4137a05c7fb60c6f52525d26d2f6c1c10ec55c529f6c8a1a14f050e1e01244b7","observation_id":"73192f2e-d815-474c-9e2a-c1bcd1a10d26","resolution":{"observed_at":"2026-08-10T21:59:10.295021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:59:10.267646Z","title":"Covers and Protectors:Use them as covers for plants during winters or protect delicate surfaces in transit","venue":null,"work_id":"2380ccb8-37ca-4245-8731-5a94ab6121ca","year":null},"citing_paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T21:59:10.184366Z"},"links":{"citing_paper":"/paper/2501.03486"},"observation_digest":"sha256:dfb52d428e5a23de8ebf4763bf62385a9272627aecafcba6c7d0540c4a6502cd","observation_id":"b7e26d24-e29b-48f9-a72e-00c3c684fb64","resolution":{"observed_at":"2026-08-10T21:59:10.277704Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.03486","last_updated":"2025-01-07T03:14:39Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T07:55:10.106515Z","submitted_at":"2025-01-07T03:14:39Z","title":"Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":52},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 1 inbound Pith citation observation for arXiv:2501.03486."}