{"as_of":"2026-08-17T19:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:295c1eb189eb0b5d92547307b114cc5e81b34d8188509ed6d3e8b791b7254fe6","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:26:53.128079Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T02:25:54.160882Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T03:40:54.567829Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"cited_work":{"arxiv_id":"2509.07006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07006","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2509.07006 , year=","venue":null,"work_id":"28e889e8-c3a5-41e8-86d2-934e1694ec3f","year":null},"citing_paper":{"arxiv_id":"2605.07515","last_updated":"2026-05-08T09:45:25Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:45:25Z","title":"An Automated Framework for Cybersecurity Policy Compliance Assessment Against Security Control Standards","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-11T02:25:54.160882Z"},"links":{"cited_paper":"/paper/2509.07006","citing_paper":"/paper/2605.07515"},"observation_digest":"sha256:baa20c9fa2de8a87fa7ecdb4d75174819e46b988290578076890f5cab6899d18","observation_id":"36f0ab0e-b25a-4e32-bc3b-6acc883ef9f3","resolution":{"observed_at":"2026-05-11T03:40:54.569469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.07006/citation-record","integrity":"/paper/2509.07006/integrity","json":"/paper/2509.07006/citation-record.json","paper":"/paper/2509.07006"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s42256-021-00323-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.396384Z","title":null,"venue":null,"work_id":"d2e64ac0-3c68-4b5f-b3b1-fb5a718f0bc0","year":2021},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.848031Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:f81772149d7fb265e03d1009b66b1f016e560bb31f706551a0fe67b2a263a795","observation_id":"fa249d92-4588-4500-9d48-7da9d67f5c93","resolution":{"observed_at":"2026-08-15T16:26:53.402666Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-15T16:26:52.854837Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.854837Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:97056fcfedd8001420bba996b9e4f1755640c2e949d77baada7f2fc1f207ace6","observation_id":"ee3b24b1-85f2-4f71-bce5-fd0b8c4bb81d","resolution":{"observed_at":"2026-08-15T16:26:52.854837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:52.861299Z","title":"FeedbackLogs: Recording and Incorporating Stakeholder Feedback into Machine Learning Pipelines","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.861299Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:65a01eb036a392b8abea6f64dbdb3bfafc12a411ce442d1cd8bc071fe65ccba3","observation_id":"5dd75a43-3384-41bf-93bc-c88949164e74","resolution":{"observed_at":"2026-08-15T16:26:52.861299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-662-48899-7_37","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"Modelling moral reasoning and ethical responsibility with logic programming","venue":"Lecture notes in computer science","work_id":"52a6d56c-af65-45e1-b74d-17dfcef144bf","year":2015},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.866555Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:f6b1e2c3f3d9dac0d109a733ca7056612a0e5406a46406096672f9c488d79bd6","observation_id":"f4710fcb-8f86-43d5-9753-9eb79054e862","resolution":{"observed_at":"2026-08-15T16:26:53.379609Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.34313","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.277507Z","title":"When Should Algorithms Resign? A Proposal for AI Governance","venue":null,"work_id":"105abafa-8560-42f8-9ad0-748bfbbdf9ab","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.873492Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:8e5385f34e7d49c1cfb11557b445189cada22de495b4dc8647445ba05ac64374","observation_id":"9b074c3b-e88a-44b2-91a6-923c6b9fd60f","resolution":{"observed_at":"2026-08-15T16:26:54.288168Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:52.879008Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.879008Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:b228e227ee29c891c40931b66cf3aeef1bbbc6671d3187054c0b78e815c88a55","observation_id":"4634952b-d99c-49e9-8d58-be547e70cea8","resolution":{"observed_at":"2026-08-15T16:26:52.879008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:52.886800Z","title":"Vera Liao, Prasanna Sattigeri, Riccardo Fogliato, Gabrielle Melnikov, Ranganath Krishnan, Jason Stanley, Omesh Tickoo, Lior Nachman, Adrian Cheng, and Kush R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.886800Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:a4e4974d5d1c6b63f9135f7eb49d74990adbcb21dd3f74c1e6c74db2e436d2ca","observation_id":"27ebfc6d-0a57-422b-afbf-31ccba477b2b","resolution":{"observed_at":"2026-08-15T16:26:52.886800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.568883Z","title":"Superintelligence: Paths, Dangers, Strategies","venue":null,"work_id":"a3b5e873-de37-4b2a-83d4-d89e2e737e08","year":2014},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.898956Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:0d78c8a613f563ff3de58c63b8f836872fade06b05acf069f0bb15ff5cfb2af5","observation_id":"50a5a9e7-0dad-4833-a37d-1a24d3103977","resolution":{"observed_at":"2026-08-15T16:26:54.574130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:52.904380Z","title":"Harms from Increasingly Agentic Algorithmic Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.904380Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:3166e301402e8425a39fd3d9e25950c104ab5e74cb8382bf25422e9a19f8e309","observation_id":"76001f45-0b05-4cfa-b021-6319504e43cb","resolution":{"observed_at":"2026-08-15T16:26:52.904380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00146-022-01456-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.352677Z","title":"Confucian Ethics and AI: Towards Harmonious Human-Machine Interaction","venue":null,"work_id":"9a7236a7-b992-4021-91e1-3047125972f9","year":2023},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.909399Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:195175f19c362465d1ee0fe0357f04a090fcb0155475e045f878181be94e60b3","observation_id":"2a3d0433-460d-48c7-a47f-6c05cfdda440","resolution":{"observed_at":"2026-08-15T16:26:53.360584Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-12T12:29:44.507445Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-15T16:26:52.914337Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.914337Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:991ae6332b47fdba223718601ef855cdd38d0e893021d175bb7d51614078a9ce","observation_id":"3bf52532-aed5-4752-bc30-a077d466382c","resolution":{"observed_at":"2026-08-15T16:26:52.914337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.553661Z","title":"Achieving EU AI Act Compliance by Integrating Governance as Code (GaC) and Machine Learning Operations (MLOps)","venue":null,"work_id":"83850634-3c52-461d-ab10-f6b42bdcb2a1","year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.919504Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:afa45e2bf50406b5f1fa3cb33d22bbdf66d0eeddc3a2fc0c3673a4d5a86bc67b","observation_id":"a5f7ced4-a4d3-4e3d-8c11-48759187c401","resolution":{"observed_at":"2026-08-15T16:26:54.558537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:52.924465Z","title":"Collins, Ilia Sucholutsky, Umang Bhatt, Adrian Weller, Thomas L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.924465Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:283bd9d33c803393614b23c80778e3794631898319cea6c489db1be7f2bc22dc","observation_id":"53599dfe-1688-4d51-a0ba-da9f713a2a55","resolution":{"observed_at":"2026-08-15T16:26:52.924465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-17T04:59:59.434643Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-15T16:26:52.929255Z","title":"Process Reinforcement through Implicit Rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.929255Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:74272bea7fc05c8ba734cc3c96202e0268f54f9ff0124d2e0723344e099e78de","observation_id":"da7549c6-f490-45e1-97b7-79b27da8778f","resolution":{"observed_at":"2026-08-15T16:26:52.929255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T16:26:52.934071Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.934071Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:80cc3784a4bdb2082a04b16737c9e0c3908c4bd9d61120db10cb0a193e286ca6","observation_id":"65cc20c8-df71-4118-a21b-3cfdb5aeeff8","resolution":{"observed_at":"2026-08-15T16:26:52.934071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:52.938613Z","title":"Dennis, Michael Fisher, Marija Slavkovik, and Matt P","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.938613Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:a22dedef97b1dc3759426ee132e687e69b4a5c0222dcd44f2247bc8bf004d4de","observation_id":"3d8c81c6-47db-424d-86f4-7710bdbcbe2b","resolution":{"observed_at":"2026-08-15T16:26:52.938613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-08-17T10:18:05.650518Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-15T16:26:52.943079Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.943079Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:825c116053a852cb7dec87c5b2dcbc14b73a92a751ab244b9d6d1a19a5345295","observation_id":"8d01316c-08d5-4570-8588-65f276f0ff1c","resolution":{"observed_at":"2026-08-15T16:26:52.943079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00146-021-01386-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.309358Z","title":"Ubuntu and Artificial Intelligence: Towards an African Ethical Framework","venue":null,"work_id":"38effb88-83af-4aab-831e-3e00a7a90535","year":2022},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.947833Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:b81572e3bd413485205660ba6eaea126402f7af2ffdeab957fa4e7973924f036","observation_id":"81014b0b-6e4e-45c7-8b0e-1772d12fe360","resolution":{"observed_at":"2026-08-15T16:26:53.315826Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00146-018-0846-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.292204Z","title":"Buddhist Ethics and AI: Compassion-Based Approaches to Artificial Intelligence","venue":null,"work_id":"ad55dd54-eb59-42a6-8d12-ad4d2411a3a8","year":2019},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.952640Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:b104ab9176eb68b256bb778961cb0f2aea3303e9000fdc76a302ca9430624f03","observation_id":"8841a5c9-780d-42b7-8cbf-7897e6162dc7","resolution":{"observed_at":"2026-08-15T16:26:53.297447Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1057/dev.2011.86","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.273798Z","title":"Buen Vivir: Today's Tomorrow","venue":null,"work_id":"c0923d93-de59-464a-b56e-466c1168d74d","year":2011},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.957988Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:83f789cf9dbf3dbe9b45a10da0346953b14053d85953bffb672b0440b9f7e093","observation_id":"85d26e96-f27d-4929-a946-9dcdd74c21c2","resolution":{"observed_at":"2026-08-15T16:26:53.279919Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.536921Z","title":"Introduction to AI Safety, Ethics, and Society","venue":null,"work_id":"d11476e9-5705-4e84-bc73-4c6d318f7997","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.963236Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:8bc69ab465023ddf318dc4a9c63d10d6f16ce1258103951e056eb574a3d90700","observation_id":"b9a7e6de-b239-475b-8458-3a85bdabf65b","resolution":{"observed_at":"2026-08-15T16:26:54.542396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10632","last_updated":"2025-07-30T14:35:05Z","snapshot_observed_at":"2026-08-16T14:16:48.833399Z","submitted_at":"2024-05-17T08:49:34Z","title":"Towards interactive evaluations for interaction harms in human-AI systems","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10632","snapshot_observed_at":"2026-08-15T16:26:52.967518Z","title":"Towards interactive evaluations for interaction harms in human-AI systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.967518Z"},"links":{"cited_paper":"/paper/2405.10632","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:bf4d9141cd635af34af9f74fc50016ca4f453fa45d42e32454379e7fe29af880","observation_id":"099095ce-d0ee-4835-ab59-06ea1161a122","resolution":{"observed_at":"2026-08-15T16:26:52.967518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.519865Z","title":"Gordon, Caglar Gulcehre, Dongyeop Kang, Maarten Sap, Amy Zhang, and He He","venue":null,"work_id":"d8770444-1c00-404f-aefa-23985acb8e9d","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.973342Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:723bec6294182519015deffa0461a697bd257cb033259e01e6882c0d735519fd","observation_id":"1a1e38cd-4044-4975-8536-8cc3de103757","resolution":{"observed_at":"2026-08-15T16:26:54.525122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12345","last_updated":"2024-04-18T17:20:16Z","snapshot_observed_at":"2026-08-16T13:59:41.360362Z","submitted_at":"2024-04-18T17:20:16Z","title":"High spin axion insulator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12345","snapshot_observed_at":"2026-08-15T16:26:52.978011Z","title":"Efficient Uncertainty Quantification for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.978011Z"},"links":{"cited_paper":"/paper/2404.12345","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:73a736a553e6f1379714f8984c564d67aaf6806d3e8df71303fc4c30fbc4e505","observation_id":"58dca08c-85ea-4e18-abab-d3727fca59e7","resolution":{"observed_at":"2026-08-15T16:26:52.978011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16468","last_updated":"2026-06-17T06:47:51Z","snapshot_observed_at":"2026-08-17T15:24:44.254524Z","submitted_at":"2024-12-21T03:51:04Z","title":"The Road to Artificial SuperIntelligence: A Comprehensive Survey of Superalignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16468","snapshot_observed_at":"2026-08-15T16:26:52.982927Z","title":"The Road to Artificial SuperIntelligence: A Comprehensive Survey of Superalignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.982927Z"},"links":{"cited_paper":"/paper/2412.16468","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:243052824164b39020b8d050a311cdaf479233810a661ad75c49f323e47f60ca","observation_id":"38e519cd-c847-4145-9cf5-935b972e2d39","resolution":{"observed_at":"2026-08-15T16:26:52.982927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10551-021-04987-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.254448Z","title":"Confucian Values in AI Development: A Framework for Ethical Technology","venue":null,"work_id":"373de15f-68ce-472a-bb35-141839db06e9","year":2022},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.989197Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:986055d2c2a4935634123cc07a7d97a3ae602cc131570e697913de31900edc85","observation_id":"4171fc9f-ad2e-4430-992e-a19bb54d166e","resolution":{"observed_at":"2026-08-15T16:26:53.260399Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14733","last_updated":"2024-12-19T11:02:49Z","snapshot_observed_at":"2026-08-16T21:14:56.088114Z","submitted_at":"2024-12-19T11:02:49Z","title":"Topological eigenvalues braiding and quantum state transfer near a third-order exceptional point","version":1},"cited_work":{"arxiv_id":"2412.14733","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14733","snapshot_observed_at":"2026-08-15T16:26:53.874586Z","title":"Topological eigenvalues braiding and quantum state transfer near a third-order exceptional point","venue":"quant-ph","work_id":"58898133-5c39-41a8-b605-58cd010bd57c","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:52.994667Z"},"links":{"cited_paper":"/paper/2412.14733","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:8bf833c88c3464e9baca46ff25a363621e570f0dc30d8a6e186c5d3972362e03","observation_id":"4abdc95f-7c89-4e08-ad0a-8c235a3b69fd","resolution":{"observed_at":"2026-08-15T16:26:53.879887Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08603","last_updated":"2025-01-31T05:28:15Z","snapshot_observed_at":"2026-08-16T05:19:04.695947Z","submitted_at":"2025-01-15T06:00:50Z","title":"Monte Carlo Tree Search for Comprehensive Exploration in LLM-Based Automatic Heuristic Design","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08603","snapshot_observed_at":"2026-08-15T16:26:53.000305Z","title":"Evaluating the Consistency of LLM Evaluators","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.000305Z"},"links":{"cited_paper":"/paper/2501.08603","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:0bb65cdb48dffe223bb220d69f5b6c411ae801c33671d385667ba1d9746cab37","observation_id":"46604d68-be3d-4041-9bc1-a805f513d267","resolution":{"observed_at":"2026-08-15T16:26:53.000305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.502688Z","title":"From Rationality to Relationality: Ubuntu as an Ethical and Human Rights Framework for Artificial Intelligence Governance","venue":null,"work_id":"84a97cff-ed7a-42f2-a620-bac61b2d2a89","year":2020},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.006468Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:53bc6dc279a230501554cdc387c0050848871abece6e709bb6cc6e452ffaac03","observation_id":"28c0d855-d4d7-4bfe-8fdd-1f0195ece22c","resolution":{"observed_at":"2026-08-15T16:26:54.508883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.011677Z","title":"Decolonial AI: Decolonial Theory as Sociotechnical Foresight in Artificial Intelligence","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.011677Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:11266f476a3fe610e5391706564ac1b834e9bc9b66397aa6a81aa8ecb4c8156c","observation_id":"a1bfe3e2-dd21-4ac2-b700-66b33ea006b1","resolution":{"observed_at":"2026-08-15T16:26:53.011677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.12688/wellcomeopenres.23021.1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.228059Z","title":"The Ubuntu Way: Ensuring Ethical AI Integration in Health Research","venue":null,"work_id":"48e038eb-8beb-4956-b30c-71266eea3393","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.017589Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:f78b5de89ac7aa0ec3f3ed59507773cd1bc597a64fd294bd2cf88923a8f2b42b","observation_id":"70fb6c68-b68f-47fc-983d-8a83dfe813fc","resolution":{"observed_at":"2026-08-15T16:26:53.233222Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00146-024-02065-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.209433Z","title":"Cognitive imperialism in artificial intelligence: counteracting bias with indigenous epistemologies","venue":null,"work_id":"6bec7fef-f92a-4ee6-a8f9-68bf9672c10d","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.023430Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:b6f676eaa539e05e9621f266851cc34ec7d56e051a988a79a36d72d8a88b2caf","observation_id":"94a99a66-1493-4e33-9421-1d4bb37eb2e0","resolution":{"observed_at":"2026-08-15T16:26:53.215912Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.481474Z","title":"Open Policy Agent Documentation","venue":null,"work_id":"0ed59224-19e1-4fd8-9464-1fb06034e685","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.028318Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:45ac5315fbcd19825fadaf4e03dde31b8b9946fcfcde4d701714581ba778f045","observation_id":"c63e8aef-0dcc-4da3-961c-a44abc494cb2","resolution":{"observed_at":"2026-08-15T16:26:54.487672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.459156Z","title":"Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, John Schulman, Jacob Hilton, Fraser Kelton, Luke E","venue":null,"work_id":"7b76ec05-8543-4a33-bcff-d62e1244fe36","year":2022},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.034880Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:966a110f1fc18503fdb89c0500da3f206f61b059327e01c30d115ddc9709dc34","observation_id":"b076bd39-16dc-44db-bdb6-ef0622c5dca8","resolution":{"observed_at":"2026-08-15T16:26:54.467615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.443242Z","title":"GOPAL: Governance Open Policy Agent Library for AI System Evaluations","venue":null,"work_id":"96bfb336-d07d-40fa-8299-e29719a54dab","year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.041556Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:ddffb8d2a0f9cbc891f673ca3bdb841003076e535d502f3ca67cc4983c8763bf","observation_id":"36c42f60-7e48-42f9-aa52-f2607889018c","resolution":{"observed_at":"2026-08-15T16:26:54.448176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.428241Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","venue":null,"work_id":"71689739-4096-427e-a923-e51246b8cdbc","year":2023},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.047214Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:a816f3546747a9d25cf58af83439e0534b50c8438c069e10a5704fb28b75777e","observation_id":"ec199ffe-87f7-48e4-8e40-91968b938a93","resolution":{"observed_at":"2026-08-15T16:26:54.433327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.411800Z","title":null,"venue":null,"work_id":"feebba99-bcc1-4501-b18c-05cf158468da","year":2019},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.052578Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:3874ae5f2f9a977fe615d928ff67bbab8c8133a8c14f340e0ee5fdec5b6bde13","observation_id":"9ce9153c-f6de-4247-aa07-34229d5929b4","resolution":{"observed_at":"2026-08-15T16:26:54.416667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.058557Z","title":"Re-imagining Algorithmic Fairness in India and Beyond","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.058557Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:c9a04a9f0674386f41711ed0069a614c322f15b05834454db9178d8bdbc332e6","observation_id":"911f9df6-488b-4741-9d87-ff27681510b0","resolution":{"observed_at":"2026-08-15T16:26:53.058557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T16:26:53.065616Z","title":"Proximal Policy Optimization Algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.065616Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:2ebdd6fa471b6eeea9e818460662c4f9bd59e9953d8b6c950bf2a55ffcfb96a3","observation_id":"b385bd80-f7b8-4fa4-b8b0-6fac6d0bc5d7","resolution":{"observed_at":"2026-08-15T16:26:53.065616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T16:26:53.070700Z","title":"Group Relative Policy Optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.070700Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:2fc7d1741fb13d26f8ab885445db65446a84a8aced3a1cfb079d53b1df3d1903","observation_id":"16c3ad40-dfa6-426e-9308-7e77f3e7b1b3","resolution":{"observed_at":"2026-08-15T16:26:53.070700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:54.394190Z","title":"Susiddha AI Project: Dharmic Frameworks for AI Development","venue":null,"work_id":"7599fb25-f6fb-46df-91ba-b3b47cf32275","year":2024},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.076236Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:c73acc0534300a0d357af9e08624c1ed824b16d6ced6f97b79e48bc8ab5141e2","observation_id":"5c26cbf3-529f-47ab-b7f6-9b5d8f13278e","resolution":{"observed_at":"2026-08-15T16:26:54.399547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.080891Z","title":"Varshney","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.080891Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:a032bd6a1f28cca24a040562bf9f64c190399aaf63abfd6a91831f334735e06e","observation_id":"841b2c01-0a83-46dc-b905-ae5f810e6df9","resolution":{"observed_at":"2026-08-15T16:26:53.080891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v36i9.21188","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.193367Z","title":"On the Fairness of Causal Algorithmic Recourse","venue":null,"work_id":"90fbee21-e6a3-46ed-8586-e15fb111714d","year":2022},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.087658Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:d25979272b779e55d71f2801402dc221fc7ea950f8b03856d46911fb87236285","observation_id":"0a6ddb81-80ca-40fd-8781-4fe238aa8792","resolution":{"observed_at":"2026-08-15T16:26:53.198823Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aimag.v29i4.2065","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.173205Z","title":"Machine Ethics: Creating an Ethical Intelligent Agent","venue":null,"work_id":"43455920-2e68-456b-9062-6a64f04a9ee5","year":2008},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.094667Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:877764fde08e00f4582222ef80aa1a7f663fe4290055475d2b7dc30cca5a9cb5","observation_id":"611d6fb4-3e7b-439f-927d-a8a3be294c7f","resolution":{"observed_at":"2026-08-15T16:26:53.181323Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-08-13T07:37:18.494967Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-08-15T16:26:53.100627Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.100627Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:cc3a7bc6aa21662ffe71b314fc100f1b3ed3dcef88ebba78dfac206007d4ec66","observation_id":"5ef44ee1-9582-49a2-993b-acf1684f6fa5","resolution":{"observed_at":"2026-08-15T16:26:53.100627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10669","last_updated":"2025-05-19T02:25:35Z","snapshot_observed_at":"2026-08-16T12:51:35.616902Z","submitted_at":"2025-03-10T09:52:42Z","title":"UC-MOA: Utility-Conditioned Multi-Objective Alignment for Distributional Pareto-Optimality","version":2},"cited_work":{"arxiv_id":"2503.10669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.10669","snapshot_observed_at":"2026-08-15T16:26:53.624486Z","title":"UC-MOA: Utility-Conditioned Multi-Objective Alignment for Distributional Pareto-Optimality","venue":"cs.CL","work_id":"4aa9583b-20e9-4266-9254-c9cf0fe7db30","year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.106287Z"},"links":{"cited_paper":"/paper/2503.10669","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:6f6728f9c3d4c8474628da9e8dbe5021496e8e3882dd15f0871859c6e0b0dd82","observation_id":"6011e29e-71e3-440b-ae73-55888d3890eb","resolution":{"observed_at":"2026-08-15T16:26:53.630010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12345","last_updated":"2023-01-29T03:59:33Z","snapshot_observed_at":"2026-08-16T15:59:26.568180Z","submitted_at":"2023-01-29T03:59:33Z","title":"Chemotactic motility-induced phase separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12345","snapshot_observed_at":"2026-08-15T16:26:53.111340Z","title":"Robust Metrics for Concept Representation Evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.111340Z"},"links":{"cited_paper":"/paper/2301.12345","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:523c31029266458f850d94738e263730cf9b644341191cc4d951d7e2d58d7a6d","observation_id":"e31dfc4c-6f6e-4ced-9795-9e5d86379c3f","resolution":{"observed_at":"2026-08-15T16:26:53.111340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:26:53.117357Z","title":"Adaptive Group Policy Optimization: Towards Stable Training and Enhanced Performance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.117357Z"},"links":{"citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:7bf65c6d25a68861715b07e81b623fe137494b51a37eecd5aae1f184ff620a43","observation_id":"aeb34150-c008-4bce-a39f-c5c9f64e5118","resolution":{"observed_at":"2026-08-15T16:26:53.117357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13124","last_updated":"2025-01-21T05:36:13Z","snapshot_observed_at":"2026-08-17T04:06:54.970565Z","submitted_at":"2025-01-21T05:36:13Z","title":"Debate Helps Weak-to-Strong Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13124","snapshot_observed_at":"2026-08-15T16:26:53.123046Z","title":"Debate Helps Weak-to-Strong Generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.123046Z"},"links":{"cited_paper":"/paper/2501.13124","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:b99ca73c3eed80e23a9bcc022a1f07b8d688e5f7cb20947d748b09c7289355e0","observation_id":"6e052142-40ff-4270-a482-cb3d6643cbe3","resolution":{"observed_at":"2026-08-15T16:26:53.123046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-08-13T12:34:54.476684Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-15T16:26:53.128079Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T16:26:53.128079Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2509.07006"},"observation_digest":"sha256:dc2e0aec8a110d63c48611f0965547f6233b85163eda78dac2640b30c67d133e","observation_id":"b6f0452f-7794-49f0-bcf7-1e02412030ed","resolution":{"observed_at":"2026-08-15T16:26:53.128079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.07006","last_updated":"2025-09-06T04:33:16Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-16T02:36:29.992408Z","submitted_at":"2025-09-06T04:33:16Z","title":"ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":26,"verified_exact":12,"verified_fuzzy":10},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2509.07006."}