{"as_of":"2026-08-10T13:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:324ea2fc3e92a11728716a8d0a9f26b9370708db857f721a5082b7de71c3f2cc","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:04:19.556483Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13175/citation-record","integrity":"/paper/2607.13175/integrity","json":"/paper/2607.13175/citation-record.json","paper":"/paper/2607.13175"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:08.625922Z","title":"2006 , month =","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:08.625922Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:9d82fab2cd82e27ba3de3773ea2a446525f36e1256261b9f4009c026e1b6c7b9","observation_id":"4c8603d5-5b52-4dd2-a03d-2526103f2f2f","resolution":{"observed_at":"2026-08-02T06:04:08.625922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:08.765994Z","title":"Vannithamby and G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:08.765994Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:001b4ffb56015479ce1c4e94d1c89fae5cbd4f82d9e50764203339f3aa81c386","observation_id":"ae618ba1-5893-4951-8e16-8ecba56e89f5","resolution":{"observed_at":"2026-08-02T06:04:08.765994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:08.911412Z","title":"Aalto and P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:08.911412Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:86d195791c1f47813253a7e7a3a2faf5c27f1cc9b50300ef9ab9e297679487e3","observation_id":"a7cb61dd-ff88-4c00-a204-7e5b93a3bfcb","resolution":{"observed_at":"2026-08-02T06:04:08.911412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.041108Z","title":"and Lassila, P","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.041108Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:57a8175913f58db9cb53c0855c1a17105326334d0866c4e4d613de4ed607eb2c","observation_id":"a837212c-44b5-4fcd-a92b-93dcc4247e84","resolution":{"observed_at":"2026-08-02T06:04:09.041108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.299074Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.299074Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4f4c816746a0d501e1939cd0f13969343f379ee637a360361f004ce46c10d7d8","observation_id":"688cc3c4-16b1-4377-863a-5a28336fe0d9","resolution":{"observed_at":"2026-08-02T06:04:09.299074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.412883Z","title":"and Yi Lu and Campbell, R.H","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.412883Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a849989ba5f760ae0b032f296c40ec1085165db5ecca4de3be6bd7890d34d698","observation_id":"5063c6d9-3b8e-44bf-b831-bbad4bbbac79","resolution":{"observed_at":"2026-08-02T06:04:09.412883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.635646Z","title":"and Cuomo, F","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.635646Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:c54a8f24b4dbff19fe41cf41b5d6a6787b7782b1762b75550d44f7dab5e85020","observation_id":"68ef79c5-f1da-41b7-8dd8-cfd43449a7d9","resolution":{"observed_at":"2026-08-02T06:04:09.635646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.794360Z","title":"2011 , volume =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.794360Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:331ffb88849fbab0c466b807070a0cd5f627d9ad48b51b4b117e57f84a6978b8","observation_id":"df7e729e-ea7d-40eb-9648-5081c03f0de5","resolution":{"observed_at":"2026-08-02T06:04:09.794360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:09.994609Z","title":"Abe and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:09.994609Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4bd49f5e6af53c85c140625ee374ce26ec22bd291df7310dffb02c31542274a8","observation_id":"b7bb6c77-86eb-4c1f-817f-03de150793b6","resolution":{"observed_at":"2026-08-02T06:04:09.994609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.135232Z","title":"Abrams and H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.135232Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:99bff8997b9d2a457061cf12d4f67549947aad63bf2ec1bb90b2d766cd4e0917","observation_id":"3f25818e-e19e-4fa1-a3c7-bb3a2e22a5ab","resolution":{"observed_at":"2026-08-02T06:04:10.135232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.365566Z","title":"2006 , pages =","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.365566Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e7ec6d3bb72854c8aa459803899db4cebadc72103fdfbc7850aa77221ce374aa","observation_id":"632a313a-f844-40a5-948f-745cc3494af6","resolution":{"observed_at":"2026-08-02T06:04:10.365566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.561373Z","title":"and Lobel, Ilan and Ozdaglar, Asuman , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.561373Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1f7a03baf5ca8a644dc3c92cddd4251481ab2e4607aa7ce648b76a1228aab39e","observation_id":"79d6d9cf-a76f-45de-946a-3f430510df47","resolution":{"observed_at":"2026-08-02T06:04:10.561373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.700343Z","title":"Adireddy and L","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.700343Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1e9628d19b2fda5667e43d5b821f3856e4585404496b47a76c17b57fef801076","observation_id":"e36e8d99-5011-4ccd-9783-34b7927e37c1","resolution":{"observed_at":"2026-08-02T06:04:10.700343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.799359Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.799359Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:272b8d1bcaf36d045c1efd387ae40bb022e3f93d721ac3df11f3afb7da28ab16","observation_id":"cffe906c-d405-4afa-90aa-790d7c972d69","resolution":{"observed_at":"2026-08-02T06:04:10.799359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:10.940933Z","title":"Aeron and V","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:10.940933Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3d4c233518f454f7bdcc008e24835d660ca5332107e1062c102ed54b6187444a","observation_id":"c2de790b-2f25-411c-a398-74f0eab1d4ea","resolution":{"observed_at":"2026-08-02T06:04:10.940933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.120227Z","title":"Agarwal and P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.120227Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3afcbf7d61cae465fd621e93c45dcf3e490c54f9728489b4ba5cf5d8353822ba","observation_id":"a8eee2ef-5021-4e02-9f50-9dc066bf13be","resolution":{"observed_at":"2026-08-02T06:04:11.120227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.215987Z","title":"SPIE Optical Engineering and Applications , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.215987Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3f17d0e562ae0a065b72b791ed2fee013679f07199755487813aeffebb80f309","observation_id":"8190dfb5-e08f-461e-8c8d-dd6a9ecaa995","resolution":{"observed_at":"2026-08-02T06:04:11.215987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.414166Z","title":", title =","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.414166Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:81f0c1fe3959c0452de3e29b91152e5b5c9c2abbd81cf48bf2462908633f07f1","observation_id":"15e0dbae-b0e1-4e4e-89d1-19af64f1b687","resolution":{"observed_at":"2026-08-02T06:04:11.414166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.551874Z","title":"2000 , pages =","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.551874Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5aea9dd1ec59509680c3dce95c9f97882ed54d47bf5d93253033a1fc31d7433b","observation_id":"37fede57-5c6b-4c1d-b27c-54425cc42ae3","resolution":{"observed_at":"2026-08-02T06:04:11.551874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.746537Z","title":"Ahmad and U","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.746537Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:7e928c027c9419d582b75eeb96fe6d33ac9329f7e20b915187fc852869f14308","observation_id":"ff3f3581-7403-4d78-9359-b130ddf410d8","resolution":{"observed_at":"2026-08-02T06:04:11.746537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.860950Z","title":"Aikat and J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.860950Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:55606bd34d2b9312f47de23cf336c495f35d6ee30b8406fbd3abb1a53bc30e10","observation_id":"787e20b8-d83f-4a65-bcfe-7bf14ab49391","resolution":{"observed_at":"2026-08-02T06:04:11.860950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:11.970727Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:11.970727Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ee86d3e666d354b99a5a23c7e1e23c03ff911dd7ff98af7b86c6b663a5b15a18","observation_id":"bb56f219-18e7-4e71-85d3-884eac12d014","resolution":{"observed_at":"2026-08-02T06:04:11.970727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.097602Z","title":"and Tanaka, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.097602Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ade8641b288bbd56b72ce555a0a8dd7802a5f31aeafa9115a4436aaad258cf6e","observation_id":"5e11333d-69ee-4593-87f7-9fd867ad6300","resolution":{"observed_at":"2026-08-02T06:04:12.097602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.287285Z","title":"and Andrews, M","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.287285Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e7c16c9df41cf5e002a559d5cb4d555bdf36f279c52b51c3ec7021f45459a13f","observation_id":"169222a4-b3e8-448d-a4ee-4bd9608bf441","resolution":{"observed_at":"2026-08-02T06:04:12.287285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.347909Z","title":"and Lee, W.Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.347909Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:cbb140c97b1fb2585b5cc071da95a1f2f0d25ff4ec38b7eec6a248510b501c6d","observation_id":"f19fbb37-1c98-4be7-9656-9f3e38713484","resolution":{"observed_at":"2026-08-02T06:04:12.347909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.404951Z","title":"Albert and H","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.404951Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:79b3181ffb71f042339704acbfafdd9fccce71585f25e403c7a7939170a5ee00","observation_id":"9c5633b1-983d-4b2a-9bcf-04773c6996ff","resolution":{"observed_at":"2026-08-02T06:04:12.404951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.454084Z","title":", title =","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.454084Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:235a305cd604744172f8d955f6bb3d14a17a6cebe71f6253131ea98c3c487cd7","observation_id":"49f983a9-4bb5-4171-b066-d110a3a8eb44","resolution":{"observed_at":"2026-08-02T06:04:12.454084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.540529Z","title":"2008 , pages =","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.540529Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f2e156faa7d8f290936f0cbf5dc247cadf2262b34500b00c91a7cbfd487609e7","observation_id":"c91ed57b-a98b-4587-afed-2e4427a80a87","resolution":{"observed_at":"2026-08-02T06:04:12.540529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.617663Z","title":"and Basar, T","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.617663Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ab71ef611ceadbba5b0c04cc5be496f81e96f2c3e111cf479373243c7e5048fa","observation_id":"e47c07a4-c338-45be-b0c0-a80f38bdbe86","resolution":{"observed_at":"2026-08-02T06:04:12.617663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.677699Z","title":"and Basar, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.677699Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:56ba46671d0c69bfd692a95f8646f67380fe511e71a8866069664a79e55da190","observation_id":"34107c31-ced3-467f-893a-b6669fc1419f","resolution":{"observed_at":"2026-08-02T06:04:12.677699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.762909Z","title":"Differential Privacy: On the Trade-Off between Utility and Information Leakage , booktitle =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.762909Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1bf73ad0d6cc70a809cb82ccbc3b0b6deb9e0e94ddf268f64337c2549e1c5f4a","observation_id":"469da460-f314-4bbc-a2d5-e62cd65e2c1a","resolution":{"observed_at":"2026-08-02T06:04:12.762909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:12.909554Z","title":"User Modeling, Adaptation, and Personalization , publisher =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:12.909554Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5f338370916ea6d0a959f6e47acec0e4122c5cf21c0e00b0d3a5785a7204112e","observation_id":"861a84f8-a423-43fd-ad19-fbbdea7db818","resolution":{"observed_at":"2026-08-02T06:04:12.909554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.028168Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.028168Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:12047f80207e94afb8b1249944e1b9dbb213b9eebc86182cad2f0f515ce97ec8","observation_id":"02ff49a2-f345-4a03-b7ab-6db954f665e3","resolution":{"observed_at":"2026-08-02T06:04:13.028168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.138310Z","title":"2011 , pages =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.138310Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:32af8ce7b632f596096c37d93cbdbd673c11483f8b693aaa3be2590d923a7cb4","observation_id":"d66f9912-f1e0-4198-bd4c-86d5b2fe49a0","resolution":{"observed_at":"2026-08-02T06:04:13.138310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.282698Z","title":"Probability in the engineering and informational sciences , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.282698Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:32b9af5dad61b9554e4b3fb0eaa965043ebcaa8e2270f0ab4f4240063cd7dff5","observation_id":"e8f502c8-d5d3-4180-acbd-25a8072525e5","resolution":{"observed_at":"2026-08-02T06:04:13.282698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.406649Z","title":"2012 , pages =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.406649Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1d712fe67f21ecdd88de04c66ec333784e0a345870344a71dba7b365ad25ba4b","observation_id":"c89e53ca-707d-4d92-ad96-94ec7ff22966","resolution":{"observed_at":"2026-08-02T06:04:13.406649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.516834Z","title":"2010 , pages =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.516834Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b2d08f083cb0f18d9ac806110272f0dc742866b50e6e2f2f381eb6e202979c8f","observation_id":"6c28ebf1-7573-43da-8c1f-f407822589b9","resolution":{"observed_at":"2026-08-02T06:04:13.516834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.694115Z","title":"Anderegg and S","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.694115Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ebbe3425d2e2fabbed38ed7a89cd9a688735733365e312dd485886c88a041f49","observation_id":"0c05e812-0542-4557-a627-d694de35c9b5","resolution":{"observed_at":"2026-08-02T06:04:13.694115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.810670Z","title":"Andrews and K","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.810670Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3ad2e99db1ba375a143dd9f4f4e6d4c14f80e0de07a74a73623fbf301787e43d","observation_id":"05866463-389f-4184-887a-4a50154395ca","resolution":{"observed_at":"2026-08-02T06:04:13.810670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:13.923630Z","title":"Andrews and K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:13.923630Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:3ecf2297d7a7d86ba0d0fe0337fbe3934e6180b18f680fe79a6ae0cb10312328","observation_id":"bf7ccf9a-7bb7-49dc-b64c-d92dbcfb4198","resolution":{"observed_at":"2026-08-02T06:04:13.923630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.035280Z","title":"and Shakkottai, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.035280Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e65f7d8937eb53518f4bf8d739c1518d66aa9ed9a1856388fd3d6a19f04daa7a","observation_id":"9c49e957-6811-47ca-abe7-21400a150e67","resolution":{"observed_at":"2026-08-02T06:04:14.035280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.158580Z","title":"Anshelevich and A","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.158580Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ea09e81680fc845137be5c80f97b441d94a9213378d729b10ef6bae4d052d238","observation_id":"b0df3807-5dee-4327-aba1-2fbeb4087e55","resolution":{"observed_at":"2026-08-02T06:04:14.158580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.289746Z","title":"IEEE Data Engineering Bulletin, , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.289746Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5f38666e20c6968b304950adf481a3d3f8dc443de0a4912865f827f822c47d39","observation_id":"5055f825-da3e-4e78-b567-6ed16be29e57","resolution":{"observed_at":"2026-08-02T06:04:14.289746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.361404Z","title":"2013 , pages =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.361404Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6bc44e8dcc0be4529a92bce3dc33f724d15e4f20e9fa82501a4d44d1325f8193","observation_id":"283774b5-fd62-4a78-b15f-aaf6c033ae41","resolution":{"observed_at":"2026-08-02T06:04:14.361404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.454040Z","title":"Arisoylu and T","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.454040Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f9a6fa5e678cc29bc77ae90ddcf584378d29f24a85186e3685ad8801c4b10ca2","observation_id":"6a551fc5-2b78-494b-afe5-4604bb35a652","resolution":{"observed_at":"2026-08-02T06:04:14.454040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.538714Z","title":"Armony and N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.538714Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:508451d2e7db00f2c405a94d8242c7569505a659c023eaaa08c149e014af0090","observation_id":"c9bb1e1c-188e-442a-be77-fb951f13a9ba","resolution":{"observed_at":"2026-08-02T06:04:14.538714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.628792Z","title":"and Fox, A","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.628792Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:06dcd4012467052c403a2823f6a7f98a86e3c73df7b3e6807219cd781e98d292","observation_id":"fd3aa400-7860-49a8-9b09-836c00375df4","resolution":{"observed_at":"2026-08-02T06:04:14.628792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.725088Z","title":"2003 , author =","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.725088Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e07986420eec71276803382308c7da282ade610469432f34199477f3527a853a","observation_id":"2626532b-dc29-4587-9a27-21f461bdac14","resolution":{"observed_at":"2026-08-02T06:04:14.725088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.810048Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.810048Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:26bd18321a7a30a7fa8f49b8d4c3a384a3a63503fff33516e1baa06292457008","observation_id":"136274b2-1547-4062-a1ac-b54264d2ba4d","resolution":{"observed_at":"2026-08-02T06:04:14.810048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1005.4984","last_updated":"2010-05-27T04:31:05Z","snapshot_observed_at":"2026-08-03T09:59:44.036329Z","submitted_at":"2010-05-27T04:31:05Z","title":"Backpressure-based Packet-by-Packet Adaptive Routing in Communication Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1005.4984","snapshot_observed_at":"2026-08-02T06:04:14.873411Z","title":"and Bui, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.873411Z"},"links":{"cited_paper":"/paper/1005.4984","citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:d62fabce58793fd579e4bb855e42c413d46d9ea24d4b8b237ecc7ccf5fd5b121","observation_id":"0e3fad15-f6e8-4c7d-9971-f3476280fc85","resolution":{"observed_at":"2026-08-02T06:04:14.873411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:14.979593Z","title":"and Bui, L","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:14.979593Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:232d4d770aa1cd2f8e834054769fc4e348cb3f2a5d00bf870d28ffcd447d63e0","observation_id":"19b4219f-30bb-4e22-973c-f70ce659618c","resolution":{"observed_at":"2026-08-02T06:04:14.979593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.051956Z","title":"Athreya and Soumendra N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.051956Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2b62dec6ec20978968fc57b094403467af57fd39b4f77b28305c2b2c92412acd","observation_id":"0eafb62a-cd9b-4c27-b61c-56b063b84de6","resolution":{"observed_at":"2026-08-02T06:04:15.051956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.129303Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.129303Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:19213b25b977d02967224450dafce14e7c9978b25f2d36851e46a2798de77640","observation_id":"ebebfd89-85cc-4d55-b990-746c5a213564","resolution":{"observed_at":"2026-08-02T06:04:15.129303Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.224815Z","title":"Auer and N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.224815Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:69dbb41ccfc7067b25594767f19e20a4d02757989ba92e8b110e7c39b67a43fc","observation_id":"3f9908d8-5b6a-4225-bc7e-ac1752385d24","resolution":{"observed_at":"2026-08-02T06:04:15.224815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.301641Z","title":"and Azar, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.301641Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:c250ab00d8322e5b03617e36848859fc2d2b1cc869e3da6c84d0523697810c37","observation_id":"176229f4-e003-4c86-b9d5-9acb5c4591df","resolution":{"observed_at":"2026-08-02T06:04:15.301641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.397428Z","title":"Axelrod , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.397428Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:55c37e0f3ca4ca6594b96a5ac7d074f26e2149e3b9b714c35fa88660482d5cca","observation_id":"d7b1ba66-3e1a-4f4d-a2ea-7d5e661278ae","resolution":{"observed_at":"2026-08-02T06:04:15.397428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.520890Z","title":"and Erausquin, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.520890Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:47af1ad72c3c0721d0b888775128dd3f2006cc0b30548c440f8d7ba611d35db7","observation_id":"8edb92c6-90ee-41f6-a386-d03dc6141e56","resolution":{"observed_at":"2026-08-02T06:04:15.520890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.599051Z","title":"2007 , pages =","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.599051Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:addd9426e68ef36c373b34d2f352d676d8c5a4972cf26644d17b8034fd010bc7","observation_id":"f6680a55-bb69-4cab-923b-73bbce69357e","resolution":{"observed_at":"2026-08-02T06:04:15.599051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.717037Z","title":"2009 , author =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.717037Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:60d0199223cbe00d2cf84aa84a7343617725b64819ceb25bb02acd6aabaa57ba","observation_id":"a58b0d77-cc57-4fc9-b58a-9c579ba17a8e","resolution":{"observed_at":"2026-08-02T06:04:15.717037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.772179Z","title":"and Khude, N","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.772179Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:134ce6e576e1a00d3d01d49e1bac65fece209c47fca6d54adbfc958b18c27911","observation_id":"6b42d9af-64ce-4474-9fec-e67a7170dedc","resolution":{"observed_at":"2026-08-02T06:04:15.772179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.833044Z","title":"and Li, J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.833044Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:dbeccc05d42375840d939d7167a94b4090f757750d4f89e97093185178186bbf","observation_id":"b9d781f6-d5cf-4bf8-83fb-c1ff8174ce1e","resolution":{"observed_at":"2026-08-02T06:04:15.833044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:15.931118Z","title":"and Har-Peled, S","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:15.931118Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:d2d5932c2e208c0926bb021981911fad2f7efe1ca4f6d308f329dcacb75d5c36","observation_id":"0da3e92f-51c1-48f7-8db1-ed0042e88985","resolution":{"observed_at":"2026-08-02T06:04:15.931118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.012285Z","title":"1975 , author =","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.012285Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:29c16dc846ea46b00a4b3501307af292b6dfc9093f8f0345c701373e1fd0bf39","observation_id":"3301aafc-16b2-4e3f-a297-ef2752bc8b3b","resolution":{"observed_at":"2026-08-02T06:04:16.012285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.081212Z","title":"Ballester and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.081212Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:9d9c3ee2d2e8fbcf9597fd8bad7094d0e92934b4ee910c64621649163c217cdf","observation_id":"609679b3-bc8a-4dfb-bc29-a7f9eebd9ee0","resolution":{"observed_at":"2026-08-02T06:04:16.081212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.183732Z","title":"Bala and S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.183732Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:8f553b32a27a627a3bfa75ad97fb877688e622abc6a65478efc1cf94b30e7e5e","observation_id":"0563b8e8-2ce2-4973-b564-db9fea259e7e","resolution":{"observed_at":"2026-08-02T06:04:16.183732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.240413Z","title":"Balasubramanian and B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.240413Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:39a01574ddbb65ede126c44839ea7015cddbab04fbc13c7c4a4e87fde3b4e1f7","observation_id":"dae56b26-db04-456e-9ab4-aeb21813e6c5","resolution":{"observed_at":"2026-08-02T06:04:16.240413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.303912Z","title":"Bansal and M","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.303912Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6f3847f78beb7ccf6a81a5072c19a8243c2ad827fe5255961552c401e336ebc9","observation_id":"f7558ef4-ff41-48ff-84e8-2d8cb24420e4","resolution":{"observed_at":"2026-08-02T06:04:16.303912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.429777Z","title":"Bansal and Z","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.429777Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4270e62a8bcab04dbf55b1bc6e3c8e1ad664c8160c976882f002ca076863dfaa","observation_id":"9a59eb14-02e8-4529-abaa-40f93a9ef665","resolution":{"observed_at":"2026-08-02T06:04:16.429777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.518600Z","title":"1988 , pages =","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.518600Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a995cf70bb9a80cfbc2be13569613e7cb48758c723e86cc12ba6d538ada4fa76","observation_id":"b71be42e-eca4-4c88-8a9a-a19b91e03d0f","resolution":{"observed_at":"2026-08-02T06:04:16.518600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.631888Z","title":"Barabasi and R","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.631888Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:998dddf9259516060d16fa1333ecfa84b8a48bb1331108aa9210027b29d27e98","observation_id":"4f9a312f-86d0-403e-8ca3-4c337fd43f8d","resolution":{"observed_at":"2026-08-02T06:04:16.631888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.760955Z","title":"2005 , publisher=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.760955Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:608f128bdbb0355e46d3a665029c35a0c817c03e888455570fe5744e6018fc49","observation_id":"15e25146-9512-4ba8-9bfe-c573d94761bc","resolution":{"observed_at":"2026-08-02T06:04:16.760955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.834924Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.834924Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:5e79fd33814b374dfeb722a0e15ef9b6556b0567df364f908e389f378829a873","observation_id":"50161783-c97f-4a2d-8eb4-5117b7d2b6e4","resolution":{"observed_at":"2026-08-02T06:04:16.834924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:16.895671Z","title":"Journal of statistical physics , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:16.895671Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:532effe32fee498cce760562214278d15f749974efbaa1e73646df3a9621d910","observation_id":"bf7cdbdd-22ce-4668-8dcd-79671806b9e9","resolution":{"observed_at":"2026-08-02T06:04:16.895671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.021934Z","title":"New York Times , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.021934Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f28d5a710bd21df66eb311049b707ef093da97057ce1fee4b76e133d8f3e4aff","observation_id":"f8971c78-0e6e-41a5-b3fd-712cf826958a","resolution":{"observed_at":"2026-08-02T06:04:17.021934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.108948Z","title":"2015 , pages =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.108948Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:9752b7bc440f4ee3a8ddd557c63ec3f273e5f88e87ada3dc9dc8073c76a7edfc","observation_id":"e2924e32-7b66-440c-94f3-077f9a2446a8","resolution":{"observed_at":"2026-08-02T06:04:17.108948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.270521Z","title":"Bayati and B","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.270521Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:6b6ebd66ad7e9d9da470e38099caf31f14ac88e7666f47f2136ec37a237a8909","observation_id":"cbb163a7-20f5-42ad-abb2-1ebfe5b707e0","resolution":{"observed_at":"2026-08-02T06:04:17.270521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.441014Z","title":"Bayati and D","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.441014Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:96d02d13f5848aff199f3b86a49b217adc451ee067ce7557e52ce5bfb8583e22","observation_id":"811b2d1e-aeba-4914-9224-d1d5817248cb","resolution":{"observed_at":"2026-08-02T06:04:17.441014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.609612Z","title":"and Buyya, R","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.609612Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4fd7af3b650b2589de30581589d9c4e63397ba14d7b1bca31dd75b94b346d573","observation_id":"9e9a3496-5c3c-4497-9af9-ee181b1d4d05","resolution":{"observed_at":"2026-08-02T06:04:17.609612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.704877Z","title":"Benson and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.704877Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:1b9536b05ea00ac8845c840ac05aa441ef75f6b36c83e165d10ac7afe99d281a","observation_id":"88430f98-4aa4-493c-af01-85793da0cb7b","resolution":{"observed_at":"2026-08-02T06:04:17.704877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.799918Z","title":"Approximating st minimum cuts in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.799918Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:73d1ccf67971ded1c99a62fe151e5b55ad6f526219f5e71a959a6f4c523e2f1e","observation_id":"2a0d5376-8006-43b2-b469-386709ff1c70","resolution":{"observed_at":"2026-08-02T06:04:17.799918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.877954Z","title":"and Peres, Y","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.877954Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:a230a3b2274e96950efef50377ae822ba4ba28347114cc30c45bcd69312d2568","observation_id":"6b4410dc-2727-4161-8420-2a978268a7a7","resolution":{"observed_at":"2026-08-02T06:04:17.877954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:17.983602Z","title":"1999 , author =","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:17.983602Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:81e6bd3f7c20aea8845a6ac7379773426cba5b9aed180f5b911d98c14e206672","observation_id":"56aa69d9-3347-4056-969b-6a36720dc391","resolution":{"observed_at":"2026-08-02T06:04:17.983602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.068315Z","title":"Berry and R","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.068315Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:f953f76feba1a0d02c058bf0a2dea30863fe78600f61cf579723cde728d13e21","observation_id":"7c0aec66-550c-4cbf-83c3-cbba05b40c59","resolution":{"observed_at":"2026-08-02T06:04:18.068315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.193385Z","title":"Tsitsiklis , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.193385Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:fd1eb7971ef6b4b25e940813e2f26a6840ae981230d9545af29765808abcaa68","observation_id":"d3bcc715-c306-402d-83a4-a612ee561d31","resolution":{"observed_at":"2026-08-02T06:04:18.193385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.301027Z","title":"Bertsimas and I","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.301027Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:855b881c0d8a0e9e6d8a833f1c158e369afe32e04b0cc31fcb923701e953c355","observation_id":"8da07777-6d20-4ac2-83c5-95e3a116b5cf","resolution":{"observed_at":"2026-08-02T06:04:18.301027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.371362Z","title":"1989 , author =","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.371362Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:00628733602e47fe4d146dd6b59c1c7cb234f81f5d4388a40ec9af28e413e4b7","observation_id":"e9529b78-4264-4d8c-8287-4f56dd9d0e61","resolution":{"observed_at":"2026-08-02T06:04:18.371362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.451414Z","title":"Bettesh and S","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.451414Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:2df57da39393b125e364a9fd84f61b3117294ea7293ec411bf762b8ef7b406c6","observation_id":"372810ff-5237-41c3-9d97-f085495e8884","resolution":{"observed_at":"2026-08-02T06:04:18.451414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.543985Z","title":"2012 , pages =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.543985Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:63f58a41eb4628e3c10f87d9cb7753bd7f91448a594436739e9446bcc677f063","observation_id":"5df734fd-738d-4862-b8de-8a918a01843d","resolution":{"observed_at":"2026-08-02T06:04:18.543985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.639254Z","title":"and Kempe, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.639254Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:47ed05002fc2aa8497c9155ef6879409991a56f752420f442dcb54254d305ed4","observation_id":"de1299f4-d256-4c5f-9e1c-c9b24a976f30","resolution":{"observed_at":"2026-08-02T06:04:18.639254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.729603Z","title":"Bhatia and M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.729603Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ef9291b607c86c9889a463bfa3d6a44eb9eab5b106deb7e93bf0682b66f6b02b","observation_id":"dfb5c7d7-71ce-49ef-8c93-fcdb663787a9","resolution":{"observed_at":"2026-08-02T06:04:18.729603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.793978Z","title":"1992 , volume =","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.793978Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:e9dd13cbeba2b6ffa9ef7861f850824d0b5bb2941b186a7b450c95560e2dcd60","observation_id":"935496b1-c7b0-4f03-9119-bd81885e1824","resolution":{"observed_at":"2026-08-02T06:04:18.793978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.865807Z","title":"Philadelphia: SIAM , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.865807Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:ec644e8e98e0d097f1344ec38124e6bcf2aa19e916dc982955d91206198c22d3","observation_id":"941aac58-9acc-437c-8602-5951ae507ef9","resolution":{"observed_at":"2026-08-02T06:04:18.865807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:18.936267Z","title":"2012 , volume =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:18.936267Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:d89804d7877d3e184efd34344ef355a7e7b45bc203b3bb5894ee3aac7beb9174","observation_id":"c2ecb0f1-d1a5-4ebe-a1e2-28e232175e5d","resolution":{"observed_at":"2026-08-02T06:04:18.936267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.007925Z","title":", title =","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.007925Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4a3e6b7267934c9e190aee47bf411d2a0116a446257d61bfa83fe9931f8675ab","observation_id":"0c2e3827-8a14-488d-be06-d96e4cd90697","resolution":{"observed_at":"2026-08-02T06:04:19.007925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.065012Z","title":"PRISM: Privacy-preserving Search in Mapreduce , booktitle = pets, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.065012Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:4d92c594e5643be87f16035a1ac5abd03e0a741594e0b3228420b078c1d19d19","observation_id":"d6633261-bf71-41c7-92e3-ade282c8c007","resolution":{"observed_at":"2026-08-02T06:04:19.065012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.156515Z","title":"2012 , pages =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.156515Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:fff026d38a901331561c5d5b79fd1344b053c556e9d32e49f0f07be0de8c1fbe","observation_id":"facc538f-ba2e-44c2-a488-3c4b21a40cf2","resolution":{"observed_at":"2026-08-02T06:04:19.156515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.269152Z","title":"2005 , pages =","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.269152Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:835afc3cf15e24fdc30a939163b59306074d907b480796d0190e2b7ce8d6b001","observation_id":"75411e66-7539-43b2-a112-e8a13fad4c9e","resolution":{"observed_at":"2026-08-02T06:04:19.269152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.386954Z","title":"2008 , pages =","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.386954Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:31e94f578b80b0100531fc9b4c131515e67cf0e421826588e166695bdacc9689","observation_id":"e845c56c-c650-4136-8355-364bf758c1a5","resolution":{"observed_at":"2026-08-02T06:04:19.386954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.482043Z","title":"and Kochut, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.482043Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:17110755ae3f9f00fa2275fc97300853a169a5c434f15b1cc19f46a4de3639f9","observation_id":"8233ae83-09de-4230-97d6-5d4c131eb1f2","resolution":{"observed_at":"2026-08-02T06:04:19.482043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:04:19.556483Z","title":"Bodas and S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-02T06:04:19.556483Z"},"links":{"citing_paper":"/paper/2607.13175"},"observation_digest":"sha256:b339d4b59a5940e4fa8366852eaf70dca40a90217993dd1c3b790d3b53a85f10","observation_id":"c0fd3d80-76b2-49fa-ab56-33e43f7c3d5f","resolution":{"observed_at":"2026-08-02T06:04:19.556483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13175","last_updated":"2026-07-14T18:23:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T00:09:41.061438Z","submitted_at":"2026-07-14T18:23:45Z","title":"SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":99,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2607.13175."}