{"as_of":"2026-08-22T02:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77068723ff5bb364c35cb6acbdd06e05825e79200ac5e9127cc95f7892e92f94","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:31.442193Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:38:15.928177Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:38:20.641277Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.14585","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14585","snapshot_observed_at":"2026-08-06T17:38:20.641277Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","venue":"cs.CL","work_id":"e4406a92-3faf-4c7e-b375-09ea09a8f711","year":2025},"citing_paper":{"arxiv_id":"2507.11502","last_updated":"2025-07-14T15:09:05Z","snapshot_observed_at":"2026-08-12T23:31:52.879519Z","submitted_at":"2025-07-14T15:09:05Z","title":"HKGAI-V1: Towards Regional Sovereign Large Language Model for Hong Kong","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:15.928177Z"},"links":{"cited_paper":"/paper/2505.14585","citing_paper":"/paper/2507.11502"},"observation_digest":"sha256:ad88e799305a451aa30a691b2ba7f3257cf76f10f929eec6ee16d1577f9cec9c","observation_id":"48e6a4e1-d5b3-4f4b-bdc1-1603a6fae1b6","resolution":{"observed_at":"2026-08-06T17:38:20.745079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14585","snapshot_observed_at":"2026-08-05T10:39:07.039355Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:07.039355Z"},"links":{"cited_paper":"/paper/2505.14585","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:71274d72b91b5161bffbdd72e39f0f7a09b431134c41fb5ff9e70e184f930d5c","observation_id":"b83fe0b0-dcaa-4c11-b003-c3021ae15ad2","resolution":{"observed_at":"2026-08-05T10:39:07.039355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14585/citation-record","integrity":"/paper/2505.14585/integrity","json":"/paper/2505.14585/citation-record.json","paper":"/paper/2505.14585"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.09704","last_updated":"2024-03-08T21:26:49Z","snapshot_observed_at":"2026-08-17T19:14:55.976519Z","submitted_at":"2024-03-08T21:26:49Z","title":"Alignment Studio: Aligning Large Language Models to Particular Contextual Regulations","version":1},"cited_work":{"arxiv_id":"2403.09704","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.09704","snapshot_observed_at":"2026-08-07T15:37:33.721497Z","title":"Alignment Studio: Aligning Large Language Models to Particular Contextual Regulations","venue":"cs.CL","work_id":"1ae02ac2-e8e0-4f0f-a66a-7fc7dcba12dc","year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.568421Z"},"links":{"cited_paper":"/paper/2403.09704","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:093ae5355e7679223938597d1b7c18e2b5a7b52db9f9749372d20bf998ff89a5","observation_id":"39372ee0-310d-4014-9563-c6249e5ce4f3","resolution":{"observed_at":"2026-08-07T15:37:33.808468Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:24.652966Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.652966Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:41565142746e28f4a58489ccf476100151855c91ef34bdfade0f3660c8d8ebcf","observation_id":"98d5261d-aec7-41d1-87e6-b061f686cbd0","resolution":{"observed_at":"2026-08-07T15:37:24.652966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:24.786439Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.786439Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:3bc3e4c8ea748a9a761efd7f3fefaa5f9e8b590b0d8b653d892716c80803a6ac","observation_id":"e8775409-1e12-4eb4-8e46-f34f00afda2b","resolution":{"observed_at":"2026-08-07T15:37:24.786439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.08232","last_updated":"2019-07-16T17:05:32Z","snapshot_observed_at":"2026-08-16T04:27:35.721746Z","submitted_at":"2018-02-22T18:42:41Z","title":"The Secret Sharer: Evaluating and Testing Unintended Memorization in Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.08232","snapshot_observed_at":"2026-08-07T15:37:24.927576Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.927576Z"},"links":{"cited_paper":"/paper/1802.08232","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b6af520bff1c66daf0abc1e7d62818dcf380ed59da90fe63ec4a432b76977ca0","observation_id":"ba1cd59e-96f6-4094-8274-c9999a2bab12","resolution":{"observed_at":"2026-08-07T15:37:24.927576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-19T14:44:27.585280Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-07T15:37:25.072025Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.072025Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b4be97d0c108d103bd9cbd98e462a2767c00ab083c3262b76956a31580b062ae","observation_id":"73256e9c-8ad7-463d-8010-e673d7e5b027","resolution":{"observed_at":"2026-08-07T15:37:25.072025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T15:37:25.204373Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.204373Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:f6d9c02e4567133ae612a0454271ca4c7d0a8bedfb169870bf13c6a85abb47e1","observation_id":"990725b1-be1d-46c1-914d-3fc89abcb71c","resolution":{"observed_at":"2026-08-07T15:37:25.204373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:25.308495Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.308495Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6839cba2386a18d4af38c6fa2c6ea624b1bae4d79327fcf0458e94e031825c42","observation_id":"479f46f2-999d-4390-b4b3-e682553bf8d2","resolution":{"observed_at":"2026-08-07T15:37:25.308495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:25.421845Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.421845Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:8313ff14d8d3ed97d889317781e7769473480e05043557c5f1109e368f096028","observation_id":"9465ff60-eece-440f-b092-eaf26ede060d","resolution":{"observed_at":"2026-08-07T15:37:25.421845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:25.578725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.578725Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a1e62533d0f492ba00d47f649286f4b2b74fd935c51ff2a765a5991d0dec0e19","observation_id":"b4c83403-ada1-4f8e-a984-2e5013396b1b","resolution":{"observed_at":"2026-08-07T15:37:25.578725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13903","last_updated":"2024-09-20T21:14:36Z","snapshot_observed_at":"2026-08-17T13:44:40.668681Z","submitted_at":"2024-09-20T21:14:36Z","title":"CI-Bench: Benchmarking Contextual Integrity of AI Assistants on Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13903","snapshot_observed_at":"2026-08-07T15:37:25.713365Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.713365Z"},"links":{"cited_paper":"/paper/2409.13903","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b558857049464a16295d5c756010b69bd2afd42a742ef6500928d5232c379ad7","observation_id":"6f69d212-7e44-4e3a-b3e3-18fa67d7dd94","resolution":{"observed_at":"2026-08-07T15:37:25.713365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-20T04:08:34.710482Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-07T15:37:25.785540Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.785540Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6ff41146ba6778eeb072094a9e064b5005ed90a0b6f4c8b16b15d6bddb4e934d","observation_id":"fc839245-d41b-4f72-8890-306b4f6ff67d","resolution":{"observed_at":"2026-08-07T15:37:25.785540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:37:25.789933Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.789933Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a8552b67dfb585fd374019c2f5410f8b1faf2fccd424d0a31cd17b6bb89cd318","observation_id":"e587ec70-73d8-4fe2-9bc2-04b660216276","resolution":{"observed_at":"2026-08-07T15:37:25.789933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12257","last_updated":"2025-08-17T06:41:40Z","snapshot_observed_at":"2026-08-11T06:56:56.977876Z","submitted_at":"2025-08-17T06:41:40Z","title":"Structuring the Unstructured: A Systematic Review of Text-to-Structure Generation for Agentic AI with a Universal Evaluation Framework","version":1},"cited_work":{"arxiv_id":"2508.12257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.12257","snapshot_observed_at":"2026-08-07T15:37:33.066787Z","title":"Structuring the Unstructured: A Systematic Review of Text-to-Structure Generation for Agentic AI with a Universal Evaluation Framework","venue":"cs.CL","work_id":"3d1afb3d-0a84-4967-9611-0ec01beded9c","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.794251Z"},"links":{"cited_paper":"/paper/2508.12257","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:83839e1806928a154b384b98dd8adcea64858a05a839ab8e8dc3b80e1f54dc6d","observation_id":"9dab7cdd-f49e-4fbf-b733-b9dc94183f9e","resolution":{"observed_at":"2026-08-07T15:37:33.205897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T15:37:25.866924Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.866924Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:eab7da767a01571529cca2ec7c2d6e758df4cb57ffb8241fb99b127fabcb306e","observation_id":"bacdce3f-568c-49a5-ae88-18e3e8131156","resolution":{"observed_at":"2026-08-07T15:37:25.866924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11149","last_updated":"2024-10-04T03:00:43Z","snapshot_observed_at":"2026-08-16T13:42:27.171999Z","submitted_at":"2024-06-17T02:27:32Z","title":"GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory","version":2},"cited_work":{"arxiv_id":"2406.11149","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11149","snapshot_observed_at":"2026-08-07T15:37:32.813331Z","title":"GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory","venue":"cs.CL","work_id":"bcf80dfd-447c-4a66-b24a-a5c7f3dabfc0","year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.009555Z"},"links":{"cited_paper":"/paper/2406.11149","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:42b7056dca3740802ddb0a6d3866735a698320307a9b49229baa5e5a9cd95648","observation_id":"cbfdfc53-e9ef-4cc5-a835-1b4a994e05e0","resolution":{"observed_at":"2026-08-07T15:37:32.892279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09825","last_updated":"2024-04-03T19:47:54Z","snapshot_observed_at":"2026-08-20T13:45:52.221529Z","submitted_at":"2023-09-18T14:47:24Z","title":"Bias of AI-Generated Content: An Examination of News Produced by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09825","snapshot_observed_at":"2026-08-07T15:37:26.097347Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.097347Z"},"links":{"cited_paper":"/paper/2309.09825","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:4de56934114e0476cd0e55e75ab8b7407a40b831f512a9703ead08f24292228e","observation_id":"b702bf90-def5-4573-a119-0451594a1add","resolution":{"observed_at":"2026-08-07T15:37:26.097347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16289","last_updated":"2023-09-28T09:35:59Z","snapshot_observed_at":"2026-08-19T05:46:16.989652Z","submitted_at":"2023-09-28T09:35:59Z","title":"LawBench: Benchmarking Legal Knowledge of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16289","snapshot_observed_at":"2026-08-07T15:37:26.187600Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.187600Z"},"links":{"cited_paper":"/paper/2309.16289","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:7bda5694ad9baa2574cbdf0ac65ba0720db8d18a1ceda025d15a194e053e6dd5","observation_id":"27fb1375-bff2-4cba-a340-09b8db6da751","resolution":{"observed_at":"2026-08-07T15:37:26.187600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02373","last_updated":"2024-09-13T13:09:41Z","snapshot_observed_at":"2026-08-16T13:28:31.376236Z","submitted_at":"2024-08-05T10:53:51Z","title":"Operationalizing Contextual Integrity in Privacy-Conscious Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02373","snapshot_observed_at":"2026-08-07T15:37:26.304358Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.304358Z"},"links":{"cited_paper":"/paper/2408.02373","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6139610e0f3cac3d55efa579ca7be1d4b4c09b78a41420d63d54c7c77895f9f5","observation_id":"fef6c64a-e147-43c6-a8b0-824ba5572579","resolution":{"observed_at":"2026-08-07T15:37:26.304358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08567","last_updated":"2024-06-03T14:15:03Z","snapshot_observed_at":"2026-08-18T07:13:53.447155Z","submitted_at":"2024-02-13T16:06:17Z","title":"Agent Smith: A Single Image Can Jailbreak One Million Multimodal LLM Agents Exponentially Fast","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08567","snapshot_observed_at":"2026-08-07T15:37:26.435481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.435481Z"},"links":{"cited_paper":"/paper/2402.08567","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6a22c57fe0a0837931879b6d4a765c8cbf471abc3f73886549613c51c0d34867","observation_id":"b7a153d4-0757-4f75-a5ea-f25b1c108195","resolution":{"observed_at":"2026-08-07T15:37:26.435481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11462","last_updated":"2023-08-20T22:08:03Z","snapshot_observed_at":"2026-08-21T02:23:35.678543Z","submitted_at":"2023-08-20T22:08:03Z","title":"LegalBench: A Collaboratively Built Benchmark for Measuring Legal Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11462","snapshot_observed_at":"2026-08-07T15:37:26.528544Z","title":"Ho, Christopher Ré, Adam Chilton, Aditya Narayana, Alex Chohlas-Wood, Austin Peters, Brandon Waldon, Daniel N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.528544Z"},"links":{"cited_paper":"/paper/2308.11462","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:d89cba3aaa168f1fb77c514ab8ebc325a257cb94981361f117ceb6765f6401b3","observation_id":"067804ab-144d-4d0d-9762-7e1ba74c4a27","resolution":{"observed_at":"2026-08-07T15:37:26.528544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:37:26.628909Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.628909Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:0d4c3b6ad895740ae31dabae94ed00a2ba7ce1c67a4e9629fceed8b46ab26d35","observation_id":"6ba1bf51-3967-4541-bdd5-a3c618b1d5cc","resolution":{"observed_at":"2026-08-07T15:37:26.628909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-08-21T13:23:40.871665Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-07T15:37:26.704153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.704153Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:830743c6437e083c7f8e75cc62e7b6ee35fce84a4b00ca15123c3bb32c76fff9","observation_id":"a2333286-0158-4099-8106-2cacae11a345","resolution":{"observed_at":"2026-08-07T15:37:26.704153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:26.780649Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.780649Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:0f677799524566cc626fc53140fcde205d2c718e952895fad387c6a9dcbdeb9a","observation_id":"ec8375de-bade-4e2e-8ce2-8b5f1a83e83e","resolution":{"observed_at":"2026-08-07T15:37:26.780649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T15:37:26.913997Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.913997Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b1c982eb73b368ef709692d26e35fba1c62fbaede147b95a67150a729479a19b","observation_id":"4487fc13-7444-4f37-89e3-8d559c0be63a","resolution":{"observed_at":"2026-08-07T15:37:26.913997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:27.029278Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.029278Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a3a4628c586acc34b39d4ddd6c89220926067a09c956529b055a32c94d60285b","observation_id":"d1853068-8c23-40ec-bdd7-29e702130f21","resolution":{"observed_at":"2026-08-07T15:37:27.029278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10383","last_updated":"2024-09-30T11:58:27Z","snapshot_observed_at":"2026-08-16T14:51:46.668848Z","submitted_at":"2023-10-16T13:23:54Z","title":"Privacy in Large Language Models: Attacks, Defenses and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10383","snapshot_observed_at":"2026-08-07T15:37:27.148812Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.148812Z"},"links":{"cited_paper":"/paper/2310.10383","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:d92b6583395aeab4f666c37c7a9222f0b9f40fdf704b58af3be1ee94725ced9d","observation_id":"c59c179e-81a5-45a2-afc1-87ed334df0df","resolution":{"observed_at":"2026-08-07T15:37:27.148812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10053","last_updated":"2025-02-13T11:43:39Z","snapshot_observed_at":"2026-08-16T13:25:29.781392Z","submitted_at":"2024-08-19T14:48:04Z","title":"Privacy Checklist: Privacy Violation Detection Grounding on Contextual Integrity Theory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10053","snapshot_observed_at":"2026-08-07T15:37:27.233556Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.233556Z"},"links":{"cited_paper":"/paper/2408.10053","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:103cb1bc2304224aa610c6852a0c79895711ca356d7562efeb0daa3d5b3032bd","observation_id":"58eb9242-5b8c-4f41-9903-b5fdadd27428","resolution":{"observed_at":"2026-08-07T15:37:27.233556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-08-18T17:40:28.920403Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-07T15:37:27.312304Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.312304Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:10222488e0f90b516d58149b5347dffb3462de9296935b4118e6f072b42cc662","observation_id":"f7e18a7c-af09-43e7-a55d-7dc2e77a5963","resolution":{"observed_at":"2026-08-07T15:37:27.312304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17041","last_updated":"2025-05-23T06:53:04Z","snapshot_observed_at":"2026-08-21T21:53:27.350205Z","submitted_at":"2025-02-24T10:49:34Z","title":"PrivaCI-Bench: Evaluating Privacy with Contextual Integrity and Legal Compliance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17041","snapshot_observed_at":"2026-08-07T15:37:27.419956Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.419956Z"},"links":{"cited_paper":"/paper/2502.17041","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:187131fe053861d4d6545127f425f5ab1016215ebc3a1a0b082bab41399fb09a","observation_id":"7ba95d35-7c49-42cb-9484-dd87661f6893","resolution":{"observed_at":"2026-08-07T15:37:27.419956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-18T06:50:23.685098Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-07T15:37:27.502326Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.502326Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:49d063b07dd7e634476e2fc4aa19ed955d526d119e04f27b9f5d618628cad55d","observation_id":"5980dbd6-2928-4bbf-800a-fc9376c9a236","resolution":{"observed_at":"2026-08-07T15:37:27.502326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-19T17:12:26.495549Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-07T15:37:27.632302Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.632302Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:4850a9a2e4efae6c4a7b9f115c573e5cb29a34d9f48e5100eabe54ea7b3060db","observation_id":"5094c26d-9c13-4d18-bba0-2b2d99d36fcb","resolution":{"observed_at":"2026-08-07T15:37:27.632302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18438","last_updated":"2023-07-03T13:08:46Z","snapshot_observed_at":"2026-08-18T22:25:47.702587Z","submitted_at":"2023-05-29T01:18:39Z","title":"Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18438","snapshot_observed_at":"2026-08-07T15:37:27.735776Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.735776Z"},"links":{"cited_paper":"/paper/2305.18438","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:7c4b900aa812ba7d796607f360fb26d02e3af87fab33fc82ab72f2a4960279ef","observation_id":"b87d7704-760f-4733-9942-2bbf1c04246f","resolution":{"observed_at":"2026-08-07T15:37:27.735776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-07T15:37:27.835124Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.835124Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:5799d18740d1d9def116eaee589f583932df72dd279274a6353e4835c535a917","observation_id":"c30a8834-e4ad-45dd-a616-498d642e8474","resolution":{"observed_at":"2026-08-07T15:37:27.835124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-08-21T23:11:31.486806Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-08-07T15:37:27.924319Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.924319Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a6f2e9ae57255f051d0006832b489170c1635a9a8c267552dd0387cfc9f162af","observation_id":"aa9fa9bf-f5d7-4496-8632-368ff503d553","resolution":{"observed_at":"2026-08-07T15:37:27.924319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17884","last_updated":"2024-06-28T23:27:10Z","snapshot_observed_at":"2026-08-19T22:25:04.716939Z","submitted_at":"2023-10-27T04:15:30Z","title":"Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17884","snapshot_observed_at":"2026-08-07T15:37:28.028759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.028759Z"},"links":{"cited_paper":"/paper/2310.17884","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:397e48f597b941346cd2a5fb20065f8627f2d698b252a39968b25a9e4ca4f71b","observation_id":"3d6c3987-3ffe-4eb9-9cc3-45ea47f9aea6","resolution":{"observed_at":"2026-08-07T15:37:28.028759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:34.123096Z","title":null,"venue":null,"work_id":"e6ebe1b4-1da7-4838-ad3e-c63beb10637d","year":2009},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.162230Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:bb52388520cb63c55cb1ac05f10323a08e98707686896e08371c4364e7777efd","observation_id":"11479c46-247c-49e9-a952-b96ccdbb76b9","resolution":{"observed_at":"2026-08-07T15:37:34.235599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T15:37:28.278624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.278624Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6399694c27fa9160d019ca6ecee7a6f8b0a4050d3b7b5b317b7d1fb10c9b2011","observation_id":"de1ba10a-b695-469b-8824-53816953cf6f","resolution":{"observed_at":"2026-08-07T15:37:28.278624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:33.951446Z","title":null,"venue":null,"work_id":"6df5668a-d45d-4723-bbe7-b94ee0322379","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.400443Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:799909ffef2e4173c134e73b828e2551fd67e921711443d1b9e68eb2b6b03348","observation_id":"62b6b9ae-bcd5-4c87-8601-37f27a930680","resolution":{"observed_at":"2026-08-07T15:37:34.042678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T15:37:28.515613Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.515613Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:e717cb842fb190d9e7b996b7ef8a2e1f027cfa1bdb115406bf139f781efc1002","observation_id":"6618858b-b737-4f8a-92d8-c33b401ca31a","resolution":{"observed_at":"2026-08-07T15:37:28.515613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:28.688518Z","title":"Brendan McMahan, Sergei Vassilvitskii, Steve Chien, and Abhradeep Guha Thakurta","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.688518Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:e8b71b438b1a8289d3cbbbc8c8db9ad18b7819ccd92a8678832822e2a45b6d12","observation_id":"486809dd-1a11-4bb1-8fa9-8b0e89c82e63","resolution":{"observed_at":"2026-08-07T15:37:28.688518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:37:28.876330Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.876330Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:23ec07f9d89f512b71489779fe5e5a07d47e079d54dca1b5f27d7a8b61735129","observation_id":"5cb2798a-9944-4a40-8031-4ef46e772760","resolution":{"observed_at":"2026-08-07T15:37:28.876330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-16T10:42:13.725165Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-07T15:37:29.013764Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.013764Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:1036468c64ee4e077c6e2b2c06e3a2cf8bf280ad3a769113bc9308751f48dcc0","observation_id":"f3a04e38-52b1-4441-8be7-adac42b2cf39","resolution":{"observed_at":"2026-08-07T15:37:29.013764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-08-15T12:05:11.299477Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-07T15:37:29.124059Z","title":"Jordan, and Pieter Abbeel","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.124059Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:008306f5181425010e86af9006f7d547481fc8f0bbabe0fd43c0f4be5de8ba10","observation_id":"62e3c68a-c131-4125-af26-f5768d6306aa","resolution":{"observed_at":"2026-08-07T15:37:29.124059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-07T15:37:29.274966Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.274966Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:2e583c0a8f8af7d05353cc16b78b6462643ed3d50d87518b79882ea811edbee7","observation_id":"92e376a2-5fe9-4744-831c-413a80925506","resolution":{"observed_at":"2026-08-07T15:37:29.274966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T15:37:29.386957Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.386957Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:18bf02f5c18fb614cf1cca54990a6f1c583757df50824756e5993e9c8ec2819b","observation_id":"66cd6366-c2e6-4c65-8bf3-be3220eeb346","resolution":{"observed_at":"2026-08-07T15:37:29.386957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12557","last_updated":"2021-06-17T14:10:57Z","snapshot_observed_at":"2026-08-15T23:58:21.050149Z","submitted_at":"2020-06-22T18:34:08Z","title":"Just How Toxic is Data Poisoning? A Unified Benchmark for Backdoor and Data Poisoning Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12557","snapshot_observed_at":"2026-08-07T15:37:29.522948Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.522948Z"},"links":{"cited_paper":"/paper/2006.12557","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:954cfafb90f81c91128d47224906d210dce88911d571be452e4819363594ccac","observation_id":"1576fe6c-af4c-432b-af4e-5c1b6d7860b0","resolution":{"observed_at":"2026-08-07T15:37:29.522948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-08-16T09:32:10.049300Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-08-07T15:37:29.632571Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.632571Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:9ecb08091feba1d0f43925427bf67ac8595fd07e6e099cd27b9339ceb3cdc7e5","observation_id":"eb02cbac-84df-4a97-b20f-a9093090f566","resolution":{"observed_at":"2026-08-07T15:37:29.632571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16303","last_updated":"2025-05-22T06:56:51Z","snapshot_observed_at":"2026-08-15T23:45:01.233012Z","submitted_at":"2025-05-22T06:56:51Z","title":"INFERENCEDYNAMICS: Efficient Routing Across LLMs through Structured Capability and Knowledge Profiling","version":1},"cited_work":{"arxiv_id":"2505.16303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16303","snapshot_observed_at":"2026-08-07T15:37:32.300110Z","title":"INFERENCEDYNAMICS: Efficient Routing Across LLMs through Structured Capability and Knowledge Profiling","venue":"cs.CL","work_id":"0ea7b769-5dbc-48fe-bea5-e479e45301dc","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.724188Z"},"links":{"cited_paper":"/paper/2505.16303","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:4654c3eea780a52d01f12651f1a099e7daf3a4111fd85bc4980dfc4308678a02","observation_id":"c1636e9e-1bc9-45b0-b391-92f2a876e4e8","resolution":{"observed_at":"2026-08-07T15:37:32.326115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.05820","last_updated":"2017-03-31T22:17:07Z","snapshot_observed_at":"2026-08-14T21:34:36.777438Z","submitted_at":"2016-10-18T22:38:33Z","title":"Membership Inference Attacks against Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.05820","snapshot_observed_at":"2026-08-07T15:37:29.827094Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.827094Z"},"links":{"cited_paper":"/paper/1610.05820","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:95f53ed935b7d9bbe2c7be2123e2f9fcffe7695a08b6c9597502dd8ae5c27565","observation_id":"4c6097ab-0a34-4a5b-9dee-9d50b7b73b76","resolution":{"observed_at":"2026-08-07T15:37:29.827094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.03735","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:32.125970Z","title":null,"venue":null,"work_id":"db990fb2-41c5-4267-9c12-75fc1a7da181","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.969859Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:0e55ead3bf71029f97989f39a6e0ce312eb1fd8eb94b9722ef588e44c1986ded","observation_id":"fa043073-fcc7-4bcc-a37c-2c236a655372","resolution":{"observed_at":"2026-08-07T15:37:32.205258Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03691","last_updated":"2017-11-24T01:00:57Z","snapshot_observed_at":"2026-08-14T20:55:01.400478Z","submitted_at":"2017-06-09T16:26:49Z","title":"Certified Defenses for Data Poisoning Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03691","snapshot_observed_at":"2026-08-07T15:37:30.109588Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.109588Z"},"links":{"cited_paper":"/paper/1706.03691","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:9c0ea5ab5ab7b50c3ebe226da602298ff2a5b6a1bb02b2da219f12774399cb7e","observation_id":"6d6c5988-c25c-4d7a-9a8e-699ac05660b6","resolution":{"observed_at":"2026-08-07T15:37:30.109588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08432","last_updated":"2020-08-11T19:10:13Z","snapshot_observed_at":"2026-08-13T15:36:52.909716Z","submitted_at":"2020-07-16T16:16:57Z","title":"Data Poisoning Attacks Against Federated Learning Systems","version":2},"cited_work":{"arxiv_id":"2007.08432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.08432","snapshot_observed_at":"2026-08-07T15:37:31.898373Z","title":"Data Poisoning Attacks Against Federated Learning Systems","venue":"cs.LG","work_id":"df295801-8864-4b66-8266-503b1d5d5331","year":2020},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.222364Z"},"links":{"cited_paper":"/paper/2007.08432","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:36218e541858c2ad902934de88fd146f5fe725c7a200b8f5c175e180c2943829","observation_id":"a820e140-31ed-415a-bd95-f9abb0ac5a3b","resolution":{"observed_at":"2026-08-07T15:37:31.937855Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:37:30.290138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.290138Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a1593fb058dfc23f8aa095c33dca31c149883d53ac19d7586fc68a430a3e2509","observation_id":"b1eb8f5e-018f-4d87-a30f-b8e88e93bda9","resolution":{"observed_at":"2026-08-07T15:37:30.290138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:30.379542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.379542Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:65fe4b9fcc9855977d9c5df0773adb6506bcf8772b23e6c4d5ccb76f7460c004","observation_id":"a4b6069e-05b6-4e2b-b0f4-b60cb5c7be29","resolution":{"observed_at":"2026-08-07T15:37:30.379542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-19T00:49:04.283297Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T15:37:30.498244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.498244Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:d76ba814385887a56bf833901c5d50a5c92aedafef7d63f28d79ca903221cb81","observation_id":"1fbee1af-5bd7-48d0-a783-857fd091681a","resolution":{"observed_at":"2026-08-07T15:37:30.498244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15589","last_updated":"2024-11-01T16:39:36Z","snapshot_observed_at":"2026-08-20T09:59:01.744109Z","submitted_at":"2024-05-24T14:20:09Z","title":"Efficient Adversarial Training in LLMs with Continuous Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15589","snapshot_observed_at":"2026-08-07T15:37:30.568678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.568678Z"},"links":{"cited_paper":"/paper/2405.15589","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:9daa43546c0c7e1d126b026c957f2476c5bb4a0d0af57f99953b633801219845","observation_id":"bbcee3d7-8de2-4d4f-a310-df21ca0b17e2","resolution":{"observed_at":"2026-08-07T15:37:30.568678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-17T06:15:32.510873Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-07T15:37:30.637518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.637518Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:3871f39dcbc936846038f2134569fad259a2ecd8e76fac7352678911aad998f7","observation_id":"90cd7ff6-f1eb-4947-b4cd-1eaf29f02015","resolution":{"observed_at":"2026-08-07T15:37:30.637518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-15T06:02:45.207770Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-07T15:37:30.734019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.734019Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:8ae6223ddc95491a0a270e88e70ee2c7f84915e16db45cd0d2bf187b709784db","observation_id":"69f8b6ff-4719-4c93-b8b6-64d6c4e0eca4","resolution":{"observed_at":"2026-08-07T15:37:30.734019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:30.835377Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.835377Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:44888321882f65eae84fe3990502d0e51a944089e8caa089320c3171c6f678a2","observation_id":"04bd2685-fe14-4ac5-a7de-b0ab2e454d5e","resolution":{"observed_at":"2026-08-07T15:37:30.835377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:30.925687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.925687Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:86afc02db98117c143c41fb2246456e4a3fee79a48b6a2e3c60e7fd860a6131c","observation_id":"39ef9557-10bf-46a0-a162-fdd838650712","resolution":{"observed_at":"2026-08-07T15:37:30.925687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02790","last_updated":"2025-01-06T06:17:56Z","snapshot_observed_at":"2026-08-16T18:24:17.779682Z","submitted_at":"2025-01-06T06:17:56Z","title":"Segmenting Text and Learning Their Rewards for Improved RLHF in Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02790","snapshot_observed_at":"2026-08-07T15:37:31.014205Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.014205Z"},"links":{"cited_paper":"/paper/2501.02790","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:efe788bb77ad95faf90eaa52c371e28fadbf37c0b34b737d953511bd2238cc90","observation_id":"c7e0e76c-dfb0-42dd-a0ac-40850cb5cca2","resolution":{"observed_at":"2026-08-07T15:37:31.014205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06500","last_updated":"2022-07-14T22:14:17Z","snapshot_observed_at":"2026-08-20T02:39:21.861813Z","submitted_at":"2021-10-13T05:15:00Z","title":"Differentially Private Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06500","snapshot_observed_at":"2026-08-07T15:37:31.106379Z","title":"Inan, Gautam Kamath, Janardhan Kulkarni, Yin Tat Lee, Andre Manoel, Lukas Wutschitz, Sergey Yekhanin, and Huishuai Zhang","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.106379Z"},"links":{"cited_paper":"/paper/2110.06500","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:432aea1c3a6aa2fdeed8b5954640347c53ff1e992d4bcff385b6a5a84ae39807","observation_id":"bde7067d-2eb5-44ca-bf9c-a58bf81fefe1","resolution":{"observed_at":"2026-08-07T15:37:31.106379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:31.194994Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.194994Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a50006e41020565cbf28e1f403e40cb229e29332058bf24b4f5743fb3cec770f","observation_id":"fd6fddfe-7dd6-4593-9f8e-389c59ea9d33","resolution":{"observed_at":"2026-08-07T15:37:31.194994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T15:37:31.261817Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.261817Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:c26739e1c8163943ed568944cf505e5ceb389c954576ad296b20d74f790a9993","observation_id":"97a2a604-06e6-4a7c-ba26-a760461be9bd","resolution":{"observed_at":"2026-08-07T15:37:31.261817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:31.367911Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.367911Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:9c5ec2219fdba2bbcae04ecb03f82b733715e7508e194bec65681e053d4fdb0b","observation_id":"1563a4df-d57c-4a8b-a89d-2a75f427ff5f","resolution":{"observed_at":"2026-08-07T15:37:31.367911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:31.442193Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.442193Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:02d339e571e7aa3e8a78826a674e14d54c88568a1c4a26a51528c8f4df03b90d","observation_id":"2c0c20cf-47b3-4045-9497-cdbe27181b09","resolution":{"observed_at":"2026-08-07T15:37:31.442193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T19:14:14.355652Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":60,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 2 inbound Pith citation observations for arXiv:2505.14585."}