{"as_of":"2026-08-10T12:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18b58d076a3056d26606ec71abea1d2bf498ef7a392c018b4210e971c3ddedcc","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:14:23.018672Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T09:18:59.008107Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"cited_work":{"arxiv_id":"2507.16534","doi":"10.48550/arxiv.2507.16534","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Frontier ai risk management framework in practice: A risk analysis technical report","venue":"ArXiv.org","work_id":"ce6125ac-5326-45b4-86bb-f2c4737f0548","year":2025},"citing_paper":{"arxiv_id":"2606.03811","last_updated":"2026-06-02T15:54:39Z","snapshot_observed_at":"2026-08-08T01:13:52.829970Z","submitted_at":"2026-06-02T15:54:39Z","title":"AI Agents Enable Adaptive Computer Worms","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T09:18:59.008107Z"},"links":{"cited_paper":"/paper/2507.16534","citing_paper":"/paper/2606.03811"},"observation_digest":"sha256:4db0a35d4e8fbe06a5d66bb48e3f586c53c1935f6aaeae001bb163091ccc82ca","observation_id":"f781125e-9a5a-4396-87c3-56b24ecd8e26","resolution":{"observed_at":"2026-06-28T09:21:49.378804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.16534/citation-record","integrity":"/paper/2507.16534/integrity","json":"/paper/2507.16534/citation-record.json","paper":"/paper/2507.16534"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.03789","last_updated":"2024-08-31T19:15:38Z","snapshot_observed_at":"2026-08-06T13:32:54.258151Z","submitted_at":"2024-08-31T19:15:38Z","title":"BreachSeek: A Multi-Agent Automated Penetration Tester","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03789","snapshot_observed_at":"2026-08-06T15:14:21.557548Z","title":"Anthropic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.557548Z"},"links":{"cited_paper":"/paper/2409.03789","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:6b029bd5671c27a13d84c45e5d69d98926662ed1fadd447a6b3c7502a1eb0730","observation_id":"87e7b001-350c-4616-af54-89f5e6b64167","resolution":{"observed_at":"2026-08-06T15:14:21.557548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18565","last_updated":"2025-05-05T20:52:36Z","snapshot_observed_at":"2026-08-07T16:00:36.504782Z","submitted_at":"2025-04-21T11:39:22Z","title":"RepliBench: Evaluating the Autonomous Replication Capabilities of Language Model Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18565","snapshot_observed_at":"2026-08-06T15:14:21.791055Z","title":"Replibench: Evaluating the autonomous replication capabilities of language model agents.arXiv preprint arXiv:2504.18565,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.791055Z"},"links":{"cited_paper":"/paper/2504.18565","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:18268e8077da862fc7d1a6f8e8c68194ae40d0c544a2c16b0da90bf6a925224a","observation_id":"1caa89ce-d703-4800-bc51-1c1fc2ae7ed8","resolution":{"observed_at":"2026-08-06T15:14:21.791055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.021999Z","title":"Accessed: 2025-06-19","venue":null,"work_id":"5eb05500-2da5-4772-b1b7-932423b743cb","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.939704Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:089b8737c837921c10d70400ed474ed3c27d578b1415cd838d14c7edb5b0db2f","observation_id":"96732b36-dfbd-4014-a33f-523f5a0f6fc3","resolution":{"observed_at":"2026-08-06T15:14:24.027670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T15:14:22.020933Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.020933Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e2b40d3d68b5562d37364546a3837cc84e4bc3af9af24578044b61b6468e2c36","observation_id":"d3c26d2a-fd3f-4ecd-94c6-92a3d98e3565","resolution":{"observed_at":"2026-08-06T15:14:22.020933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T15:14:22.121008Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.121008Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:c9f25283c792d34beed94d02a0a3a11692a3fe686c72964f06fa6c4a4a7e60f1","observation_id":"d0e9f8ec-2569-4156-86f9-5e008b821167","resolution":{"observed_at":"2026-08-06T15:14:22.121008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:22.185824Z","title":"Sciknoweval: Evaluating multi-level scientific knowledge of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.185824Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:34cd6ce2c20a87bf54e7b64e348ac2bb0c7125f622ef936d504ce32208d8c936","observation_id":"278e80e6-66d3-409e-b85d-a4c1c121a7ef","resolution":{"observed_at":"2026-08-06T15:14:22.185824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16137","last_updated":"2025-04-29T15:14:35Z","snapshot_observed_at":"2026-08-07T16:00:27.124745Z","submitted_at":"2025-04-21T21:04:01Z","title":"Virology Capabilities Test (VCT): A Multimodal Virology Q&A Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16137","snapshot_observed_at":"2026-08-06T15:14:22.300029Z","title":"Accessed: 2025-07-13","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.300029Z"},"links":{"cited_paper":"/paper/2504.16137","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:2b7d7e676bff7a80e901386ce31ff14b6283c0124cb22b9274a70915f39a4b9d","observation_id":"25ee9542-ef06-462f-a86a-b32797ca7a00","resolution":{"observed_at":"2026-08-06T15:14:22.300029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T15:14:22.418574Z","title":"Gemini 2.5 flash preview model card, 2025a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.418574Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:dc2f8bf147164de8d738be5f8181f94f2883d613ba642adfca5836be5f37a13e","observation_id":"1f1df01c-3831-4f67-be33-83ff168ce5f8","resolution":{"observed_at":"2026-08-06T15:14:22.418574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-06T15:14:22.519969Z","title":"Alignment faking in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.519969Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:aef954d0b231f255bfef466de7546d8718dc048e1911d8861cd9959e3056b4ed","observation_id":"e4758feb-304a-485c-934f-522f1505f8f2","resolution":{"observed_at":"2026-08-06T15:14:22.519969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14143","last_updated":"2025-02-19T23:03:21Z","snapshot_observed_at":"2026-08-07T18:03:25.478801Z","submitted_at":"2025-02-19T23:03:21Z","title":"Multi-Agent Risks from Advanced AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14143","snapshot_observed_at":"2026-08-06T15:14:22.652580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.652580Z"},"links":{"cited_paper":"/paper/2502.14143","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:cfaeae6348e530dadb9e4e268fd5d676fee35f1fc147ff2825974688a7065cf1","observation_id":"c9f31935-def7-4d11-ab8f-44771815d2c5","resolution":{"observed_at":"2026-08-06T15:14:22.652580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T15:14:22.743190Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.743190Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:0ae83ad780fae32686fd13b54489d9a69675adcef11d85731a439592e728f513","observation_id":"52f89928-a294-41b3-b949-9b5b8faae16c","resolution":{"observed_at":"2026-08-06T15:14:22.743190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T15:14:22.834304Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.834304Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:0251500c80f99a88bd53da4c5a8af1a4228bba0a7db2a848c1deb92e82a37b3d","observation_id":"a6528721-9175-4293-aa54-96cae918c15e","resolution":{"observed_at":"2026-08-06T15:14:22.834304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-10T03:07:35.408836Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-06T15:14:22.844018Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code.arXiv preprint arXiv:2403.07974,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.844018Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:03cac0bc104a461bcc24daba94156b490a27e5de83cc14d2b6ab558d90b84a0c","observation_id":"c6c98204-f467-4bbd-be04-871d7c2dbfe1","resolution":{"observed_at":"2026-08-06T15:14:22.844018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-06T15:14:22.849329Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.849329Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b73643b2af78348eab52483c949872afcd402d266857c936a114b14f35f612f8","observation_id":"7cee2df6-4214-4911-bf5f-530698648edc","resolution":{"observed_at":"2026-08-06T15:14:22.849329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18807","last_updated":"2025-05-24T17:41:47Z","snapshot_observed_at":"2026-08-08T01:20:21.986624Z","submitted_at":"2025-05-24T17:41:47Z","title":"Mitigating Deceptive Alignment via Self-Monitoring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18807","snapshot_observed_at":"2026-08-06T15:14:22.854339Z","title":"Mitigating deceptive alignment via self-monitoring.arXiv preprint arXiv:2505.18807,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.854339Z"},"links":{"cited_paper":"/paper/2505.18807","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e1e3170e7c19e8245a97cf099ee02c7d8fa97a4560cf32bab47546f62fbe3926","observation_id":"50541677-0d41-417a-94bd-ff30d9a909d5","resolution":{"observed_at":"2026-08-06T15:14:22.854339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21605","last_updated":"2026-04-05T01:29:06Z","snapshot_observed_at":"2026-07-06T21:31:40.171357Z","submitted_at":"2025-05-27T17:47:08Z","title":"SoSBench: Benchmarking Safety Alignment on Six Scientific Domains","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21605","snapshot_observed_at":"2026-08-06T15:14:22.859306Z","title":"Sosbench: Benchmarking safety alignment on scientific knowledge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.859306Z"},"links":{"cited_paper":"/paper/2505.21605","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:8bed32d371c2f232e90cd310d0a969a707767e1fcd6913580138934d9c964aed","observation_id":"c1dfdbb7-93ca-471b-a80f-efbeddb31a2d","resolution":{"observed_at":"2026-08-06T15:14:22.859306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20787","last_updated":"2025-01-06T07:22:50Z","snapshot_observed_at":"2026-08-05T03:53:59.997985Z","submitted_at":"2024-12-30T08:11:54Z","title":"SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20787","snapshot_observed_at":"2026-08-06T15:14:22.863925Z","title":"Secbench: A comprehensive multi-dimensional benchmarking dataset for llms in cybersecurity.arXiv preprint arXiv:2412.20787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.863925Z"},"links":{"cited_paper":"/paper/2412.20787","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:bef62b4cd0f645618d9d8554cef8e4cda9c66004be2a92fb559002d89df4f202","observation_id":"63ae91d0-92bf-4670-bb24-cbd6f4184d1b","resolution":{"observed_at":"2026-08-06T15:14:22.863925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10362","last_updated":"2024-07-17T17:28:36Z","snapshot_observed_at":"2026-08-06T06:16:43.714786Z","submitted_at":"2024-07-14T23:52:25Z","title":"LAB-Bench: Measuring Capabilities of Language Models for Biology Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10362","snapshot_observed_at":"2026-08-06T15:14:22.869124Z","title":"Lab-bench: Measuring capabilities of language models for biology research.arXiv preprint arXiv:2407.10362,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.869124Z"},"links":{"cited_paper":"/paper/2407.10362","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:ca41d7d6852d8c374364e426e9ff2b5a6665792293133599efe5fbd2a496ca54","observation_id":"b3adbd70-7617-4799-bb22-0bfc8b9628b4","resolution":{"observed_at":"2026-08-06T15:14:22.869124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-03T21:40:53.683032Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-08-06T15:14:22.874665Z","title":"Salad-bench: A hierarchical and comprehensive safety benchmark for large language models.arXiv preprint arXiv:2402.05044, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.874665Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:2c378e52fe4ac2fe53abb80da722867bd4a1ceb08dee2027dc96b2e5774e6853","observation_id":"f19f1ff8-ae1f-48e5-9ba7-d3826bd5e83a","resolution":{"observed_at":"2026-08-06T15:14:22.874665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:22.879999Z","title":"American invitational mathematics examination 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.879999Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:4d56ef1d81c1b18be31998ffc72913434e213bec1e90e6711d1ad4c91cde900a","observation_id":"06b97683-5d85-4068-aa1c-34b691cebdb7","resolution":{"observed_at":"2026-08-06T15:14:22.879999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.973715Z","title":"Contest problems from the 2024 AIME competition","venue":null,"work_id":"13abe770-10c4-429f-a5d6-accff294a1ee","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.884756Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:cf65bd9892807ccfa541834434723b34f9f29a58bf9785b3fc6a3b4e83b045f3","observation_id":"6fe81f37-ab14-4d38-9829-7575cc8dc8ca","resolution":{"observed_at":"2026-08-06T15:14:23.978516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06017","last_updated":"2025-04-09T13:54:18Z","snapshot_observed_at":"2026-08-09T09:01:44.523329Z","submitted_at":"2025-04-08T13:22:09Z","title":"CAI: An Open, Bug Bounty-Ready Cybersecurity AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06017","snapshot_observed_at":"2026-08-06T15:14:22.889495Z","title":"Anay Mehrotra, Manolis Zampetakis, Paul Kassianik, Blaine Nelson, Hyrum Anderson, Yaron Singer, and Amin Karbasi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.889495Z"},"links":{"cited_paper":"/paper/2504.06017","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:a250615861449bc2d31107b5c3fb30ec1ab1b17f9132b4920d11c7f9614fa678","observation_id":"cb2efb7f-7418-4292-8608-0d639b571c51","resolution":{"observed_at":"2026-08-06T15:14:22.889495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04984","last_updated":"2025-01-14T20:16:01Z","snapshot_observed_at":"2026-08-09T13:05:34.738390Z","submitted_at":"2024-12-06T12:09:50Z","title":"Frontier Models are Capable of In-context Scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04984","snapshot_observed_at":"2026-08-06T15:14:22.894587Z","title":"Frontier models are capable of in-context scheming.arXiv preprint arXiv:2412.04984,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.894587Z"},"links":{"cited_paper":"/paper/2412.04984","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:57ad01417871afd860a8881595b29847f31bff9dcfa1c8e0d85f2d8fae76e1c8","observation_id":"fdf74127-cb50-416c-9d5e-bcff8fc39895","resolution":{"observed_at":"2026-08-06T15:14:22.894587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.957277Z","title":"Responsible scaling policies (rsps).https://metr.org/blog/2023-09-26-rsp/, 09","venue":null,"work_id":"ba430a02-3e61-40a5-b72f-93d85d9cc961","year":2023},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.899057Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:862c0a60c019968a955c526e3167fd39084507bfe9e195c80f2d4cd31d5583b9","observation_id":"ba52e359-94d8-4d62-8dd2-626fc61de117","resolution":{"observed_at":"2026-08-06T15:14:23.963015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-06T15:14:22.907474Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.907474Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:a1602f0b9d6e5433eb8ae6b49ae297aa7e75a7a65fff366289968eb62b6fa8a9","observation_id":"93fac917-a50b-44f4-876f-5feedcef89f4","resolution":{"observed_at":"2026-08-06T15:14:22.907474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.942526Z","title":null,"venue":null,"work_id":"2590a158-061b-4669-84dc-9fc6e5e175c6","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.912298Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:8ae3a82e99c0ee6c0cae5ba3e3602f32946fa69b080e45eb7b9c2768d766a38d","observation_id":"be4d7f1d-a0a9-4166-83dd-5f37f87b8450","resolution":{"observed_at":"2026-08-06T15:14:23.946869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.927850Z","title":"Accessed: 2025-07-13","venue":null,"work_id":"322ce285-e64c-4199-a55b-2093464bd205","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.917782Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:8a9aa1c962e9d0cc6bd71ad2c9699be4c4c98272b0a698e75dbcf9ed0e140713","observation_id":"6acdd052-728a-470b-a7f7-8b50efb7cddb","resolution":{"observed_at":"2026-08-06T15:14:23.932093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17378","last_updated":"2025-03-25T13:38:18Z","snapshot_observed_at":"2026-08-07T17:03:48.268989Z","submitted_at":"2025-03-14T14:44:27Z","title":"Large language model-powered AI systems achieve self-replication with no human intervention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17378","snapshot_observed_at":"2026-08-06T15:14:22.922224Z","title":"Accessed: 2025-06-19","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.922224Z"},"links":{"cited_paper":"/paper/2503.17378","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:f19928b1e0033d026bcf0dba4234ab1ea3ae29b9272e5f4ded115339b2df3553","observation_id":"83e52089-9a2b-4838-b162-475dc803f59e","resolution":{"observed_at":"2026-08-06T15:14:22.922224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13793","last_updated":"2024-04-05T12:26:11Z","snapshot_observed_at":"2026-08-07T13:58:15.415231Z","submitted_at":"2024-03-20T17:54:26Z","title":"Evaluating Frontier Models for Dangerous Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13793","snapshot_observed_at":"2026-08-06T15:14:22.926909Z","title":"OpenAI Re- search Publication","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.926909Z"},"links":{"cited_paper":"/paper/2403.13793","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:938efccd1e94b26de7c107017d0acc2416362613ee68df2bd40e9eafe629ef06","observation_id":"ded1746d-a757-43f2-ae1c-421e4d68f658","resolution":{"observed_at":"2026-08-06T15:14:22.926909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00207","last_updated":"2019-08-28T21:35:38Z","snapshot_observed_at":"2026-08-10T00:37:33.892861Z","submitted_at":"2018-11-01T03:43:10Z","title":"Towards Empathetic Open-domain Conversation Models: a New Benchmark and Dataset","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00207","snapshot_observed_at":"2026-08-06T15:14:22.932039Z","title":"Towards empathetic open-domain conversation models: A new benchmark and dataset.arXiv preprint arXiv:1811.00207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.932039Z"},"links":{"cited_paper":"/paper/1811.00207","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:48853c4d93c1598a24679899563155cfd0fd4ef57a2a6a9754b60b79e456b077","observation_id":"eb9e64a6-a0eb-46a9-9d7e-d14847fea8cc","resolution":{"observed_at":"2026-08-06T15:14:22.932039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-10T12:02:35.919497Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-06T15:14:22.942276Z","title":"Qibing Ren, Hao Li, Dongrui Liu, Zhanxu Xie, Xiaoya Lu, Yu Qiao, Lei Sha, Junchi Yan, Lizhuang Ma, and Jing Shao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.942276Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:39f7889a4b0596ebd50b7fb68ff2621122ba90a8da93f2becf3d25fa4231d85b","observation_id":"8cb89a31-cc0e-4952-adca-938f89183e31","resolution":{"observed_at":"2026-08-06T15:14:22.942276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14660","last_updated":"2025-07-24T06:00:02Z","snapshot_observed_at":"2026-08-08T16:57:35.013183Z","submitted_at":"2025-07-19T15:17:30Z","title":"When Autonomy Goes Rogue: Preparing for Risks of Multi-Agent Collusion in Social Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14660","snapshot_observed_at":"2026-08-06T15:14:22.946739Z","title":"When autonomy goes rogue: Preparing for risks of multi-agent collusion in social systems, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.946739Z"},"links":{"cited_paper":"/paper/2507.14660","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:37e2d4ead02f64e047aa436486ad5ebb7e87e7640489a108ca314346dffbb520","observation_id":"0f26c0a8-a4e0-4f35-b9db-a6df662b0251","resolution":{"observed_at":"2026-08-06T15:14:22.946739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13548","last_updated":"2025-05-10T07:10:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-20T14:46:48Z","title":"Towards Understanding Sycophancy in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13548","snapshot_observed_at":"2026-08-06T15:14:22.951866Z","title":"Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R Bowman, Newton Cheng, Esin Durmus, Zac Hatfield-Dodds, Scott R Johnston, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.951866Z"},"links":{"cited_paper":"/paper/2310.13548","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:4802453c3fd2d39093af13a84779012972117fcab97d4e6e3dc6178ea14f7e77","observation_id":"1a1a5579-dcf3-487f-b11b-651db1286378","resolution":{"observed_at":"2026-08-06T15:14:22.951866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10952","last_updated":"2024-04-16T23:27:38Z","snapshot_observed_at":"2026-08-07T05:16:48.851507Z","submitted_at":"2024-04-16T23:27:38Z","title":"Can Language Models Solve Olympiad Programming?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10952","snapshot_observed_at":"2026-08-06T15:14:22.961513Z","title":"Joey Skaf, Luis Ibanez-Lissen, Robert McCarthy, Connor Watts, Vasil Georgiv, Hannes Whittingham, Lorena Gonzalez-Manzano, David Lindner, Cameron Tice, Edward James Young, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.961513Z"},"links":{"cited_paper":"/paper/2404.10952","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:8b013e9a8b76ada4713ca5c92f26e7a3cbfe5a832e2d54ebb9baa88ec7f05e62","observation_id":"31cf8291-b415-4b89-b249-67b52b43b67d","resolution":{"observed_at":"2026-08-06T15:14:22.961513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.909703Z","title":"github.io/blog/qwq-32b/","venue":null,"work_id":"833e9642-ce8d-497c-bcbd-afbaf320ace7","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.976376Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:d760a4ea04b95f6ead35a4575884c4664bc43518f39c97575b812fd43163af44","observation_id":"cf9f1a7b-47d0-49cd-b3f6-9e0ee04b9197","resolution":{"observed_at":"2026-08-06T15:14:23.915454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:22.981987Z","title":"Teun van der Weij, Felix Hofstätter, Ollie Jaffe, Samuel F Brown, and Francis Rhys Ward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.981987Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e42367d85e01b85b065ad44a46fad2f03533e6a11595d802e04fb2544c1b60f8","observation_id":"f49cb79f-7a76-4936-848c-20bd29528720","resolution":{"observed_at":"2026-08-06T15:14:22.981987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12786","last_updated":"2025-05-27T05:00:23Z","snapshot_observed_at":"2026-08-07T15:43:25.408174Z","submitted_at":"2025-05-19T07:19:06Z","title":"Forewarned is Forearmed: A Survey on Large Language Model-based Agents in Autonomous Cyberattacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12786","snapshot_observed_at":"2026-08-06T15:14:22.991593Z","title":"An Yang, Baosong Yang, Beichen Zhang, Binyuan Hui, Bo Zheng, Bowen Yu, Chengyuan Li, Dayiheng Liu, Fei Huang, Haoran Wei, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.991593Z"},"links":{"cited_paper":"/paper/2505.12786","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:139ded11135a20f1fec8db149c63964b87361d368ca38103e67e192dca007622","observation_id":"979b8ec1-35af-4b39-9e3c-5a1b481ba118","resolution":{"observed_at":"2026-08-06T15:14:22.991593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16557","last_updated":"2025-06-13T11:41:42Z","snapshot_observed_at":"2026-08-07T23:35:01.184228Z","submitted_at":"2025-05-22T11:46:46Z","title":"Is Your LLM-Based Multi-Agent a Reliable Real-World Planner? Exploring Fraud Detection in Travel Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16557","snapshot_observed_at":"2026-08-06T15:14:22.996359Z","title":"Shunyu Yao, Jeffrey Zhao, Dian Yu, Nan Du, Izhak Shafran, Karthik Narasimhan, and Yuan Cao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.996359Z"},"links":{"cited_paper":"/paper/2505.16557","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b69d5c78fc8ec748d52a10ddec335959e8c7b8fcd22a3d9b806338c49484fa6c","observation_id":"304d5447-6a79-48f7-af13-9fd530fe6518","resolution":{"observed_at":"2026-08-06T15:14:22.996359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-06T15:14:23.001640Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts.arXiv preprint arXiv:2309.10253,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.001640Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:811b7c3c6b6c0443fe7a871e1537023e0adc7ab16168819f099fd1e605718adb","observation_id":"cbe1dbe2-9e4d-41a5-bc10-fff805cfe8bb","resolution":{"observed_at":"2026-08-06T15:14:23.001640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-08-06T12:22:30.341073Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-08-06T15:14:23.006196Z","title":"Cybench: A framework for evaluating cybersecurity capabilities and risks of language models.arXiv preprint arXiv:2408.08926,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.006196Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:60826a401aae7b34d0ef2938a75348586b40a856dd44cae4e179ab69dd9e64a0","observation_id":"ca2ca46d-83e1-4bf8-b634-cbf1ce3a42f3","resolution":{"observed_at":"2026-08-06T15:14:23.006196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-06T15:14:23.014971Z","title":"Terry Yue Zhuo, Minh Chien Vu, Jenny Chim, Han Hu, Wenhao Yu, Ratnadira Widyasari, Imam Nur Bani Yusuf, Haolan Zhan, Junda He, Indraneil Paul, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.014971Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:f337d666b12998eec14268558a455b125afb0c0b8436c62ab18a2422e26b73a4","observation_id":"5f8fbb08-a161-444e-9aa8-0823e81e849d","resolution":{"observed_at":"2026-08-06T15:14:23.014971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-07-31T19:00:59.311189Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-06T15:14:23.018672Z","title":"Andy Zou, Zifan Wang, Nicholas Carlini, Milad Nasr, J Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.018672Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:06c5b087bcb3d6693bb2ae8132f5c7c5dc511a8f2727ffce1802f802118e3286","observation_id":"6c2b8b6a-ebd0-4314-91f3-d600ba8c1487","resolution":{"observed_at":"2026-08-06T15:14:23.018672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T15:14:22.804368Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":1953,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.804368Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e92a9067d2efe2e7aa261879eac1f8a8ca9fc9602fdce571fb5e437b606a5d63","observation_id":"59418bc6-79b4-4a4d-b07a-1f5276087639","resolution":{"observed_at":"2026-08-06T15:14:22.804368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08379","last_updated":"2023-11-27T19:30:35Z","snapshot_observed_at":"2026-08-05T18:30:31.616984Z","submitted_at":"2023-11-14T18:42:40Z","title":"Scheming AIs: Will AIs fake alignment during training in order to get power?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08379","snapshot_observed_at":"2026-08-06T15:14:21.887761Z","title":"Scheming ais: Will ais fake alignment during training in order to get power?arXiv preprint arXiv:2311.08379,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.887761Z"},"links":{"cited_paper":"/paper/2311.08379","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e51f7fbb60f5e5bcbd730ddfc1d407a7800f57ab13b63a6d8b61d95ee07d6bca","observation_id":"59b84338-8ab4-482f-a89f-9306667dde6e","resolution":{"observed_at":"2026-08-06T15:14:21.887761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-06T15:14:22.986497Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.986497Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b8c09268101eab0b1852edb70d3a95034148b1ff9cb7dc43d9d2c45d2fc97762","observation_id":"118bef26-7bfa-44a8-bc95-f54a0330bc81","resolution":{"observed_at":"2026-08-06T15:14:22.986497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.004334Z","title":"Biolp-bench: Measuring understanding of biological lab protocols by large language models","venue":null,"work_id":"e7dd7dc0-d18e-439d-998e-b04a9432f7fb","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.839502Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:ae6658e8938e2ba283e17bc802263faef500ee097e4a9a7f7d6bd159c97cd892","observation_id":"edd18540-d5f1-4a2b-8964-d4ab795144cc","resolution":{"observed_at":"2026-08-06T15:14:24.009701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17805","last_updated":"2025-01-29T17:47:36Z","snapshot_observed_at":"2026-08-10T04:29:34.143989Z","submitted_at":"2025-01-29T17:47:36Z","title":"International AI Safety Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17805","snapshot_observed_at":"2026-08-06T15:14:21.709311Z","title":"International ai safety report.arXiv preprint arXiv:2501.17805,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.709311Z"},"links":{"cited_paper":"/paper/2501.17805","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:30dc53353f7e201a089942f05521ef223df01328394da3752ca779cb154dda47","observation_id":"b88639e1-0404-4a6a-9840-6186f29b8de5","resolution":{"observed_at":"2026-08-06T15:14:21.709311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-06T15:14:22.971435Z","title":"Qwen Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.971435Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:7c89a0f1b7eaab086d54ce2c02c8042ee98efdd79e60c421d838878ef40cb6ac","observation_id":"c4be9b7e-cc32-4fee-8169-6250a3f5348c","resolution":{"observed_at":"2026-08-06T15:14:22.971435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05130","last_updated":"2024-12-16T02:20:31Z","snapshot_observed_at":"2026-08-03T21:21:39.149039Z","submitted_at":"2023-10-08T11:41:28Z","title":"Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability Curvature","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05130","snapshot_observed_at":"2026-08-06T15:14:21.642015Z","title":"com/production/files/responsible-scaling-policy-1.0.pdf","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.642015Z"},"links":{"cited_paper":"/paper/2310.05130","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:2695a12c0337beaa765dfd1d19e7180a224b987bd11733989b219894806de847","observation_id":"ce5731ec-f81b-4dee-a162-84c9f9a26377","resolution":{"observed_at":"2026-08-06T15:14:21.642015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.056358Z","title":"Mistral AI","venue":null,"work_id":"cad8ed88-980b-4440-b25b-52b872567660","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.421720Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:84a8680303a9386f94b4ce929078def905b9a9ffd1125900093b2314212bb546","observation_id":"52e159df-342b-41ac-b844-e667b42aae8f","resolution":{"observed_at":"2026-08-06T15:14:24.060858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.038771Z","title":"Accessed: 2025-06-19","venue":null,"work_id":"394d2fd8-8779-4218-8b73-d233683b41a7","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.487379Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:be7bf4f7b8a96984f065d054c4858fdda8b9c1797007b139f24702e4f3303e94","observation_id":"c143ecc8-b397-4d13-b15f-036849d2f37e","resolution":{"observed_at":"2026-08-06T15:14:24.044219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2507.16534."}