{"as_of":"2026-08-09T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24e1947b351df88029f969d4058b9e3c96394a91f2a548fecc46f96aa9850718","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:50:00.253920Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:48:36.924294Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:54:22.258152Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"cited_work":{"arxiv_id":"2506.09600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09600","snapshot_observed_at":"2026-06-30T07:54:22.258152Z","title":"Effective red- teaming of policy-adherent agents","venue":null,"work_id":"64490ab8-286e-4e6d-9b7f-29d09db47429","year":2025},"citing_paper":{"arxiv_id":"2510.04265","last_updated":"2026-05-12T01:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-05T16:14:03Z","title":"Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T10:04:39.223895Z"},"links":{"cited_paper":"/paper/2506.09600","citing_paper":"/paper/2510.04265"},"observation_digest":"sha256:4d1edae73dd87f67825845add5eaef3f8ceab2cdb2536ed337a63e13867b5697","observation_id":"29492dc8-2762-4be4-a9ef-17672f85925e","resolution":{"observed_at":"2026-05-18T10:06:13.730575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"cited_work":{"arxiv_id":"2506.09600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09600","snapshot_observed_at":"2026-06-30T07:54:22.258152Z","title":"Effective red- teaming of policy-adherent agents","venue":null,"work_id":"64490ab8-286e-4e6d-9b7f-29d09db47429","year":2025},"citing_paper":{"arxiv_id":"2606.29225","last_updated":"2026-06-28T06:27:36Z","snapshot_observed_at":"2026-08-07T13:05:21.494072Z","submitted_at":"2026-06-28T06:27:36Z","title":"PolicyGuard: A Dialogue-Grounded Sub-Agent Verifier for Policy Adherence in LLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-30T07:48:36.924294Z"},"links":{"cited_paper":"/paper/2506.09600","citing_paper":"/paper/2606.29225"},"observation_digest":"sha256:7aeb57d5bab1591417897bbbbffc8712a3f48165089b9bc00dccaa022927f06e","observation_id":"e24b196a-a0fd-4f1c-8ca4-5f9ae0e3084f","resolution":{"observed_at":"2026-06-30T07:54:22.260097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09600/citation-record","integrity":"/paper/2506.09600/integrity","json":"/paper/2506.09600/citation-record.json","paper":"/paper/2506.09600"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.119981Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.119981Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:39123e38acba4247bf8efcb8ccfb4a7b17267c0841732b2dcc2b0c4539b4a5b0","observation_id":"a9fe4ffe-27a7-4b2d-bac8-777d4d8dd59c","resolution":{"observed_at":"2026-08-07T04:50:00.119981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-02T12:38:54.249632Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09024","snapshot_observed_at":"2026-08-07T04:50:00.124363Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.124363Z"},"links":{"cited_paper":"/paper/2410.09024","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:3a2d64581dee4a529505cb2c76c640ac608dbaeae9e9cd6c13605ecff702a604","observation_id":"ed34efe0-0318-4a5e-a5e3-dc1c3f58dbd8","resolution":{"observed_at":"2026-08-07T04:50:00.124363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15546","last_updated":"2025-09-12T11:24:08Z","snapshot_observed_at":"2026-08-07T16:00:23.396072Z","submitted_at":"2025-04-22T02:52:08Z","title":"A Framework for Testing and Adapting REST APIs as LLM Tools","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15546","snapshot_observed_at":"2026-08-07T04:50:00.129367Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.129367Z"},"links":{"cited_paper":"/paper/2504.15546","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:8aafc3565c3f3329ba4833153d6af894bcfa544d72626e6bdf4c32fca5b65d8b","observation_id":"5bd98dfd-fade-4c92-993d-2104cf826649","resolution":{"observed_at":"2026-08-07T04:50:00.129367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T04:50:00.133366Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.133366Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:04e6e161f0f5ce393162fa46f949fe4253f9672e5387ca245df6e963288fedd2","observation_id":"03ed9a8b-08c1-47cf-a062-174d7e1d1cab","resolution":{"observed_at":"2026-08-07T04:50:00.133366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:50:00.137097Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.137097Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:d4c257734461c10df22ef48cb5f278063b3f19580878a37726a106f107ed242f","observation_id":"a98cffe2-f85d-496d-9947-cd94c9849bc6","resolution":{"observed_at":"2026-08-07T04:50:00.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.983210Z","title":null,"venue":null,"work_id":"23f8294b-51d4-4d4d-8404-db9aa78e76c6","year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.140744Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:538f914f0282901620312fb395aa5c7a1370ef465a10803004cc7279ccf95ff5","observation_id":"1e9eb559-74f2-464a-8fe8-116158765a52","resolution":{"observed_at":"2026-08-07T04:50:00.987004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.972218Z","title":null,"venue":null,"work_id":"b41ba255-9dc6-4fe7-92e6-82a96716ea57","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.144239Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:6b2819df9ecd0078e65eaa1c42ac2d2ed58586dc1e286b599acb7d00039e2f4e","observation_id":"e6252988-2705-441d-be6b-a23da52a6621","resolution":{"observed_at":"2026-08-07T04:50:00.976219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:50:00.147390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.147390Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:3886f59266b6b2963744e4405278a7108896aab8564f5c3ffba98447237077ec","observation_id":"2d02d8c2-ef73-4a6e-9b5b-998a49c59faf","resolution":{"observed_at":"2026-08-07T04:50:00.147390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.150733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.150733Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:18c444e80e686222461b389a59b54cbd96ba27ed9402b9a7673c869bba70a502","observation_id":"0fc1f222-66e5-48a6-9d06-cccaa70e343d","resolution":{"observed_at":"2026-08-07T04:50:00.150733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.12491","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.667007Z","title":null,"venue":null,"work_id":"57e6bb95-1be0-4ffd-97ca-ac43cad8c5b1","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.154869Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:23009056515706ef38f754a8aee98ac20e18e3c809b7a950b812e1ae7d165d8f","observation_id":"48730d43-8fe6-4f01-a378-2c588ee6b58a","resolution":{"observed_at":"2026-08-07T04:50:00.672247Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.961849Z","title":null,"venue":null,"work_id":"bd3dc95c-aaea-484f-880d-54cdca032df6","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.158262Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:8d57202494cc34c740757c7a4c56179fbded018c5e2a8685364c023676aafc72","observation_id":"986a60bd-ecac-46ec-ba2d-f5e102ed3cfc","resolution":{"observed_at":"2026-08-07T04:50:00.965469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04124","last_updated":"2023-11-07T16:50:33Z","snapshot_observed_at":"2026-08-02T11:30:46.576643Z","submitted_at":"2023-11-07T16:50:33Z","title":"Unveiling Safety Vulnerabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04124","snapshot_observed_at":"2026-08-07T04:50:00.161709Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.161709Z"},"links":{"cited_paper":"/paper/2311.04124","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:d7f6682c07f335e5ac6b0dc560f82a1ef289212a2a3bf00035a7d85389544c13","observation_id":"7ceccfad-f25e-486e-adc7-2455580e1072","resolution":{"observed_at":"2026-08-07T04:50:00.161709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.950457Z","title":null,"venue":null,"work_id":"b9a03dba-0f42-401d-b7ca-d51a44bfcddf","year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.165546Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:01ef741339b30f7820ec25e55656720f994f20d3a6c31a5e227b8452cad3049d","observation_id":"cc16bd91-aabd-4430-a712-cd7800f2b6f4","resolution":{"observed_at":"2026-08-07T04:50:00.953787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06703","last_updated":"2026-06-04T09:59:28Z","snapshot_observed_at":"2026-08-05T07:12:18.604381Z","submitted_at":"2024-10-09T09:13:38Z","title":"ST-WebAgentBench: A Benchmark for Evaluating Safety and Trustworthiness in Web Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06703","snapshot_observed_at":"2026-08-07T04:50:00.168901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.168901Z"},"links":{"cited_paper":"/paper/2410.06703","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:159e845c10641f23792dc2714497a13769903f53a22db6253dff0990e85aa16c","observation_id":"6c005901-1f7d-42ed-895b-fca8e3ed9781","resolution":{"observed_at":"2026-08-07T04:50:00.168901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08669","last_updated":"2025-06-17T17:50:44Z","snapshot_observed_at":"2026-08-07T17:12:14.445837Z","submitted_at":"2025-03-11T17:53:02Z","title":"SOPBench: Evaluating Language Agents at Following Standard Operating Procedures and Constraints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08669","snapshot_observed_at":"2026-08-07T04:50:00.172498Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.172498Z"},"links":{"cited_paper":"/paper/2503.08669","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:2ce4ff322746dfb8a0a45dbc34f612c21ab3ace19f569e24b90421bac8d949ab","observation_id":"d2052270-87ab-4262-b1ae-ae4e9432038d","resolution":{"observed_at":"2026-08-07T04:50:00.172498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T04:50:00.176032Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.176032Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:b358b0b8b6cf25dbcd442f3af5cfc5c5ff954ae2db9a1c7b04866e773b0bbcf1","observation_id":"1fc9cdf3-3095-4c91-9b47-b3ec89dd02ca","resolution":{"observed_at":"2026-08-07T04:50:00.176032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02777","last_updated":"2024-01-30T07:02:30Z","snapshot_observed_at":"2026-08-02T18:12:51.901453Z","submitted_at":"2024-01-05T12:26:46Z","title":"From LLM to Conversational Agent: A Memory Enhanced Architecture with Fine-Tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02777","snapshot_observed_at":"2026-08-07T04:50:00.179402Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.179402Z"},"links":{"cited_paper":"/paper/2401.02777","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:6b69bcfd5322f284d72d657b9851ad8ccdb843c02d93068f29b2da491e69bd43","observation_id":"45a07ed6-ae4e-4bc8-8523-8826db4d0170","resolution":{"observed_at":"2026-08-07T04:50:00.179402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-07T04:50:00.182946Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.182946Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:55a608347a1e3200ffc0e60a0b8fc5624ca71ef4eb785cf7f6f111a6f15f46b5","observation_id":"e4aa5648-db3b-4be7-ade6-9fd1c50de94e","resolution":{"observed_at":"2026-08-07T04:50:00.182946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-07-06T15:40:27.639368Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-08-07T04:50:00.186499Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.186499Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:e506d717dc1505ec34e8c69a8b3847056bc04cef8d8aac438ba341d7e44b0076","observation_id":"50533e89-9e21-42b8-844c-5106ca7e14f1","resolution":{"observed_at":"2026-08-07T04:50:00.186499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.940153Z","title":null,"venue":null,"work_id":"1d59e115-3724-4c22-9637-11d96ca6a617","year":2021},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.190116Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:5590cdd527c4740a6b48f99cbe442fee50a3c36569d41345cc736497583ba8d9","observation_id":"a358ba86-58cc-4329-87c5-f8f28fee284d","resolution":{"observed_at":"2026-08-07T04:50:00.943574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.929704Z","title":"u ndler, Mark Niklas M \\","venue":null,"work_id":"3c2ef65b-616a-404c-91ff-47b3a2083c06","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.193419Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:062460431eb7342fba65ff063df1720bb4a731b7ee73069c5749bada54f03cfa","observation_id":"0fde2ab8-b1f9-4dd3-afcb-8dacea8d9941","resolution":{"observed_at":"2026-08-07T04:50:00.933475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.919705Z","title":null,"venue":null,"work_id":"939bde60-3924-4db0-bdc9-ae7a09781422","year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.196714Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:e53f3fdbec5163f2863df50dd62f4e0d3b92ffcb19fe0e4f8a9e71d78dae4e82","observation_id":"5b29a17e-92b7-409b-b739-9d0cd5e120c8","resolution":{"observed_at":"2026-08-07T04:50:00.923174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.908770Z","title":"do anything now","venue":null,"work_id":"0f6a2279-8f5d-4dd8-8212-c00af7c71082","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.199724Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:3f050da585940263e47a4cfb284cf1d2731c5b71d4d78bc5c7f074d42d17776c","observation_id":"e7683656-a1bd-4537-aaef-7b477760998e","resolution":{"observed_at":"2026-08-07T04:50:00.912398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.202923Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.202923Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:aa7ac7ed164530ca9b3b29574f4daf3ddb45823cd69c1049035ec494c4ff686e","observation_id":"36f055a0-5e8a-40fb-9d6b-71cf64ba9975","resolution":{"observed_at":"2026-08-07T04:50:00.202923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01343","last_updated":"2024-07-17T07:26:47Z","snapshot_observed_at":"2026-07-06T17:54:07.815827Z","submitted_at":"2024-03-31T07:11:48Z","title":"CHOPS: CHat with custOmer Profile Systems for Customer Service with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01343","snapshot_observed_at":"2026-08-07T04:50:00.206194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.206194Z"},"links":{"cited_paper":"/paper/2404.01343","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:ded7d438084bb727356f2f6ec6c54fa7675aa828257ae4e015f0a996b9e36ebd","observation_id":"f46532e3-00d6-4dd6-99fb-2a643e881f52","resolution":{"observed_at":"2026-08-07T04:50:00.206194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-08T00:38:42.440129Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-07T04:50:00.209867Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.209867Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:98a1a8bf95ead8518f7488a2a9c2d87fcc8b9ba96cfd8d32bf0624beba8ffb67","observation_id":"ada563b1-aadb-4908-9872-59d56c02826d","resolution":{"observed_at":"2026-08-07T04:50:00.209867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.214612Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.214612Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:2c97a5f246a2f398839529d5d1a126f64e7c0a7ee5b42a6982e09010b6d28e48","observation_id":"04ecd511-17b3-4848-8819-74ac326f158f","resolution":{"observed_at":"2026-08-07T04:50:00.214612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04686","last_updated":"2024-08-08T09:18:47Z","snapshot_observed_at":"2026-08-09T04:54:31.022151Z","submitted_at":"2024-08-08T09:18:47Z","title":"Multi-Turn Context Jailbreak Attack on Large Language Models From First Principles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04686","snapshot_observed_at":"2026-08-07T04:50:00.218144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.218144Z"},"links":{"cited_paper":"/paper/2408.04686","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:64ca7edc38db1e714aa771afdc3fefe93be2af91d9cdad535d229111d1f96ecc","observation_id":"c7f4545a-55a6-4feb-8926-256a2478f566","resolution":{"observed_at":"2026-08-07T04:50:00.218144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.891533Z","title":null,"venue":null,"work_id":"3679e6fb-227a-4452-8ab9-6bd99f5697a5","year":2002},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.221806Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:ffd2b774f60da29eea886519d856d02198b94ee228b8bf7fffd0230598aa6a0e","observation_id":"0066ba6d-3785-41fd-96c2-443202205f55","resolution":{"observed_at":"2026-08-07T04:50:00.895130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03550","last_updated":"2024-03-06T08:50:25Z","snapshot_observed_at":"2026-07-06T17:40:20.922598Z","submitted_at":"2024-03-06T08:50:25Z","title":"Emotional Manipulation Through Prompt Engineering Amplifies Disinformation Generation in AI Large Language Models","version":1},"cited_work":{"arxiv_id":"2403.03550","doi":"10.48550/arxiv.2403.03550","metadata_source":"pith","pith_arxiv_id":"2403.03550","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"Emotional Manipulation Through Prompt Engineering Amplifies Disinformation Generation in AI Large Language Models","venue":"cs.AI","work_id":"8dfe4870-ce7d-4d79-be0a-fd6218430ea8","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.225273Z"},"links":{"cited_paper":"/paper/2403.03550","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:ae912b2abe7547480da492ab7208120fb93132e699416869175f29bc41828ca2","observation_id":"0c447225-0981-48ad-aafa-07b43f553d88","resolution":{"observed_at":"2026-08-07T04:50:00.289354Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03017","last_updated":"2025-01-26T01:52:22Z","snapshot_observed_at":"2026-07-06T19:27:25.061335Z","submitted_at":"2024-10-03T21:58:39Z","title":"Tutor CoPilot: A Human-AI Approach for Scaling Real-Time Expertise","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03017","snapshot_observed_at":"2026-08-07T04:50:00.228964Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.228964Z"},"links":{"cited_paper":"/paper/2410.03017","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:c9d347385d62edf01c370aa396f1b96191f5b6f5486b7774957555d79e8313fa","observation_id":"617a1164-8ca5-4f15-bafa-2f5dfbfabcb7","resolution":{"observed_at":"2026-08-07T04:50:00.228964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T04:50:00.232482Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.232482Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:a228bf5f4e6f4669c51e5bf873a9016adde64dd2483ca7ea29d796f18a30f17c","observation_id":"5f6b1128-03a9-4a3a-885e-aefa408de241","resolution":{"observed_at":"2026-08-07T04:50:00.232482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-08T21:08:39.676079Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-07T04:50:00.235971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.235971Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:d4592e7569e3d71e037e75eac237127aca65dad3321c87ce2f066f01f29d2653","observation_id":"f2aa3b30-54c0-4f1e-8b3f-35ebd1d96784","resolution":{"observed_at":"2026-08-07T04:50:00.235971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.239482Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.239482Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:9ebdbfea78e48491c8196d16ecfb883fc6d132bd20a40593e757d32b5e2bbfe0","observation_id":"bdddd043-26b7-436e-9c0a-a2d6f4633c16","resolution":{"observed_at":"2026-08-07T04:50:00.239482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16416","last_updated":"2026-04-23T17:36:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-20T17:59:23Z","title":"Survey on Evaluation of LLM-based Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16416","snapshot_observed_at":"2026-08-07T04:50:00.243042Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.243042Z"},"links":{"cited_paper":"/paper/2503.16416","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:c768ded8a52ee2c67ac04434bdb74adf36265e5a05e26e0ba5c1ed3ab2cfa925","observation_id":"a67f23d5-4b4a-419f-8f27-be2a1c2ced3d","resolution":{"observed_at":"2026-08-07T04:50:00.243042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.873889Z","title":null,"venue":null,"work_id":"36f151e3-a5d3-4615-bd3d-d0f232b271a2","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.246609Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:2b7de37417a65587a7ba8a2715d5df808016ac27b64ef9f03fbb852dca8b6404","observation_id":"816d0e1b-59bd-4e90-9fb5-a609d7754cc9","resolution":{"observed_at":"2026-08-07T04:50:00.877545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.249996Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.249996Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:3f5440f8957c1c1dcf613335ada4f75f6d9212a4922c24718e1552349f5cffa0","observation_id":"80feea2e-0a2a-4cb2-a8a6-236e3e9bf407","resolution":{"observed_at":"2026-08-07T04:50:00.249996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.253920Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.253920Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:771cea68132a7afd6b14ce38245aa1b09f65a1011f6c1d14f6d7fc5b3dec6f47","observation_id":"82e72879-d510-4f14-9dad-a2a6be99f225","resolution":{"observed_at":"2026-08-07T04:50:00.253920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","latest_version":3,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-09T02:56:27.613575Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2506.09600."}