{"as_of":"2026-08-10T14:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:46ae362a72b69b02c979b1b27641a4a975ac734cea38ac9d7e362dd037cfb15e","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:29:58.290673Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03166/citation-record","integrity":"/paper/2608.03166/integrity","json":"/paper/2608.03166/citation-record.json","paper":"/paper/2608.03166"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.11484","last_updated":"2025-01-10T02:18:01Z","snapshot_observed_at":"2026-08-10T09:55:45.782594Z","submitted_at":"2024-07-16T08:20:39Z","title":"The Oscars of AI Theater: A Survey on Role-Playing with Language Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11484","snapshot_observed_at":"2026-08-06T00:29:55.891371Z","title":"The Oscars of AI Theater: A Survey on Role- Playing with Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:55.891371Z"},"links":{"cited_paper":"/paper/2407.11484","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:c23d5eb7867aba9b61fa832f7fdee3f14b88479c2cda0857442729bdd0b5369f","observation_id":"b9fac2ea-4937-4cc2-8d6d-b81eafb9675c","resolution":{"observed_at":"2026-08-06T00:29:55.891371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09624","last_updated":"2023-11-11T05:30:34Z","snapshot_observed_at":"2026-07-06T16:33:04.032904Z","submitted_at":"2023-10-14T17:10:28Z","title":"ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09624","snapshot_observed_at":"2026-08-06T00:29:55.943379Z","title":"ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:55.943379Z"},"links":{"cited_paper":"/paper/2310.09624","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:05640d398c9a9edfbe3952017a5c0216f8940d570512ff5db9266a6b9acdbd8c","observation_id":"00c93cdc-df59-47ba-bbb0-569dfd3da8a1","resolution":{"observed_at":"2026-08-06T00:29:55.943379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T00:29:56.028755Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.028755Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:63b7bec35f63ce5d40a61926942b70e93322adfb331973ad53b8b0ff33482d9a","observation_id":"103f45a2-66bb-4496-98f7-7f48abc91fd2","resolution":{"observed_at":"2026-08-06T00:29:56.028755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:00.331000Z","title":"RoleMRC: A Fine-Grained Composite Benchmark for Role-Playing Language Agents,","venue":null,"work_id":"8ef94c39-2d3b-4394-ac7b-44f099f96449","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.129225Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:d4cde4eada93b9562e1aa6d561e03798849400fc01b224ce5e4e1d38352240ce","observation_id":"59846c01-4ae4-47c3-9ac5-60a8dff937ac","resolution":{"observed_at":"2026-08-06T00:30:00.431231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08592","last_updated":"2023-11-29T23:18:16Z","snapshot_observed_at":"2026-08-08T11:07:43.394892Z","submitted_at":"2023-11-14T23:28:23Z","title":"AART: AI-Assisted Red-Teaming with Diverse Data Generation for New LLM-powered Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08592","snapshot_observed_at":"2026-08-06T00:29:56.208408Z","title":"AART: AI-Assisted Red-Teaming with Diverse Data Generation for New LLM-powered Applications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.208408Z"},"links":{"cited_paper":"/paper/2311.08592","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:9f0e24ad63c6c2251b7833ec002089f714e73329e3191491cef157c1510ebb8c","observation_id":"153fcb74-d969-4170-8d67-9e08ce1803b1","resolution":{"observed_at":"2026-08-06T00:29:56.208408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13195","last_updated":"2025-05-19T14:50:44Z","snapshot_observed_at":"2026-08-08T18:00:53.075951Z","submitted_at":"2025-05-19T14:50:44Z","title":"Adversarial Testing in LLMs: Insights into Decision-Making Vulnerabilities","version":1},"cited_work":{"arxiv_id":"2505.13195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13195","snapshot_observed_at":"2026-08-06T00:29:59.765276Z","title":"Adversarial Testing in LLMs: Insights into Decision-Making Vulnerabilities","venue":"cs.AI","work_id":"55f2c3b2-201e-47dd-8c9f-446aeb134540","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.341529Z"},"links":{"cited_paper":"/paper/2505.13195","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:a50eba623b7c748d10fc7d65a80576f3a89447872b11bfb6cd6cb40715f2ed71","observation_id":"8416447f-0537-483c-91d7-93dbd9f4b2fc","resolution":{"observed_at":"2026-08-06T00:29:59.822893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:00.191532Z","title":"Red Teaming Large Language Models: A Comprehensive Review and Critical Analysis,","venue":null,"work_id":"d29f138b-3ed3-404d-9561-b9817e65800f","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.408327Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:68cf70286f708f661f8282c7ba1c9b633ac5ad5c9594ed31db6e64fcd272ffb5","observation_id":"4dded492-67ed-4285-83f1-5d72175ab62e","resolution":{"observed_at":"2026-08-06T00:30:00.272974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:00.036601Z","title":"Security of LLM-based Agents: Attacks, Defenses, and Applications,","venue":null,"work_id":"e2059deb-00b4-4cc7-9a17-ebee86ad450f","year":2026},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.485119Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f5c7611548c7a805b987263b3bf480f3372b9fc8e86341cc6f49ca161714bae4","observation_id":"aa86cdb8-632d-499e-98c9-a29c2ba83f91","resolution":{"observed_at":"2026-08-06T00:30:00.131587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18036","last_updated":"2025-06-22T13:34:58Z","snapshot_observed_at":"2026-08-08T14:51:59.166265Z","submitted_at":"2025-06-22T13:34:58Z","title":"Markov-Enhanced Clustering for Long Document Summarization: Tackling the 'Lost in the Middle' Challenge with Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.18036","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18036","snapshot_observed_at":"2026-08-06T00:29:59.921236Z","title":"Markov-Enhanced Clustering for Long Document Summarization: Tackling the 'Lost in the Middle' Challenge with Large Language Models","venue":"cs.CL","work_id":"f03130d7-fd1b-4730-b8d7-7ee44e52bde9","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.532477Z"},"links":{"cited_paper":"/paper/2506.18036","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:b32c573b1b91e048a398915c1423e8df991a023788791f9713ddb778028a9f36","observation_id":"4dc2bad5-597b-4a54-b856-a8b2916e6f24","resolution":{"observed_at":"2026-08-06T00:29:59.970446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09662","last_updated":"2023-08-30T10:21:00Z","snapshot_observed_at":"2026-08-06T17:01:00.147032Z","submitted_at":"2023-08-18T16:27:04Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09662","snapshot_observed_at":"2026-08-06T00:29:56.632621Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.632621Z"},"links":{"cited_paper":"/paper/2308.09662","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:bf6b8c555feb580f494efb48991af27accc93585e45b3d4d102d95567a778b09","observation_id":"51ee87da-f0b5-42b3-9169-f8cfd2021453","resolution":{"observed_at":"2026-08-06T00:29:56.632621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11083","last_updated":"2026-05-30T02:54:00Z","snapshot_observed_at":"2026-08-07T10:54:09.927091Z","submitted_at":"2025-06-04T09:09:54Z","title":"RedDebate: Safer Responses Through Multi-Agent Red Teaming Debates","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11083","snapshot_observed_at":"2026-08-06T00:29:56.700795Z","title":"RedDebate: Safer Responses through Multi-Agent Red Teaming Debates,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.700795Z"},"links":{"cited_paper":"/paper/2506.11083","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:130b44a23bae045d331426a8f4d69871d92e0e72e99824e6dcba6d1f719b6b12","observation_id":"593966c0-7a4e-4ad2-93af-ea9b594737a8","resolution":{"observed_at":"2026-08-06T00:29:56.700795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07689","last_updated":"2023-11-13T19:13:29Z","snapshot_observed_at":"2026-07-06T16:47:01.374736Z","submitted_at":"2023-11-13T19:13:29Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07689","snapshot_observed_at":"2026-08-06T00:29:56.778717Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.778717Z"},"links":{"cited_paper":"/paper/2311.07689","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:b69ea68787b61776616919770196ced877e7f97a93084c31486d0af530e4fb7f","observation_id":"edb960e9-8d02-478f-ab19-7cf4cadd7b88","resolution":{"observed_at":"2026-08-06T00:29:56.778717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11855","last_updated":"2024-02-02T08:28:01Z","snapshot_observed_at":"2026-08-07T01:32:12.754339Z","submitted_at":"2023-11-20T15:50:09Z","title":"Evil Geniuses: Delving into the Safety of LLM-based Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11855","snapshot_observed_at":"2026-08-06T00:29:56.858992Z","title":"Evil Geniuses: Delving into the Safety of LLM-based Agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.858992Z"},"links":{"cited_paper":"/paper/2311.11855","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:890e1c32a3ae0065594d41c7ba029df42c090539aed3b82df83f3b3fb403430d","observation_id":"fcd9b88f-f8d7-48cb-8a23-07b0bcc1fd3d","resolution":{"observed_at":"2026-08-06T00:29:56.858992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16667","last_updated":"2024-07-23T17:34:36Z","snapshot_observed_at":"2026-08-10T13:50:49.131833Z","submitted_at":"2024-07-23T17:34:36Z","title":"RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16667","snapshot_observed_at":"2026-08-06T00:29:56.930215Z","title":"RedA- gent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.930215Z"},"links":{"cited_paper":"/paper/2407.16667","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:3de39d0b013def63d7ed494da32b2655975d07f2b4d375fe7d7ce93bcaa268bd","observation_id":"2a562869-30fa-40f6-a310-093383e3a0f5","resolution":{"observed_at":"2026-08-06T00:29:56.930215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01304","last_updated":"2025-03-03T08:42:13Z","snapshot_observed_at":"2026-08-09T17:50:14.217689Z","submitted_at":"2025-03-03T08:42:13Z","title":"Encounter-based model of a run-and-tumble particle with stochastic resetting","version":1},"cited_work":{"arxiv_id":"2503.01304","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01304","snapshot_observed_at":"2026-08-06T00:29:59.527938Z","title":"Encounter-based model of a run-and-tumble particle with stochastic resetting","venue":"cond-mat.stat-mech","work_id":"89c49c36-8672-442f-b557-8b4ed3716167","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.998828Z"},"links":{"cited_paper":"/paper/2503.01304","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:77a98dcc64891fab0ff44ba92a5c1f931e45a717b12ace1bbcf0cefda8d2ec69","observation_id":"d28070b9-00f4-4e73-b1d8-8654f92726e6","resolution":{"observed_at":"2026-08-06T00:29:59.614995Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:29:57.065596Z","title":"Exposing Weak Links in Multi-Agent Systems under Adver- sarial Prompting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.065596Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:62e0f9f8cb09a0d925bbc67d40c896026c54c8d6c8b3836eb5b6db1868835d08","observation_id":"be359958-702e-4cb7-a28d-851c99af979f","resolution":{"observed_at":"2026-08-06T00:29:57.065596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17458","last_updated":"2024-10-22T22:27:33Z","snapshot_observed_at":"2026-07-06T19:38:09.286994Z","submitted_at":"2024-10-22T22:27:33Z","title":"Iwasawa module of the cyclotomic $\\mathbb{Z}_{2}$-extension of certain real quadratic fields","version":1},"cited_work":{"arxiv_id":"2410.17458","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17458","snapshot_observed_at":"2026-08-06T00:29:59.224087Z","title":"Iwasawa module of the cyclotomic $\\mathbb{Z}_{2}$-extension of certain real quadratic fields","venue":"math.NT","work_id":"32a325c2-9cf6-45c4-9a5c-76e747103f04","year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.300906Z"},"links":{"cited_paper":"/paper/2410.17458","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:01610308b9c04552d364bdf58664bce6baa860e63cd93411dce20d194a9a29e8","observation_id":"6913ec36-c166-4117-bbd4-745fc6aace07","resolution":{"observed_at":"2026-08-06T00:29:59.270567Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05692","last_updated":"2025-06-20T12:42:57Z","snapshot_observed_at":"2026-08-09T09:46:21.168984Z","submitted_at":"2025-06-06T02:48:02Z","title":"SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05692","snapshot_observed_at":"2026-08-06T00:29:57.375647Z","title":"SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.375647Z"},"links":{"cited_paper":"/paper/2506.05692","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:276a362240fd9529ab60794ac560b1ea51edef7b59510128acb022c3f70f5782","observation_id":"c6ca3504-9d98-4ad8-8114-0bcf1183b914","resolution":{"observed_at":"2026-08-06T00:29:57.375647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:29:57.468919Z","title":"From Prompt Injections to Protocol Exploits: Threats in LLM-Powered AI Agent Workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.468919Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:8e7ac3daf848d505521ce2a2384ab876bea1c192737f58a5dc6737f3c272e932","observation_id":"a3dc3093-1dfc-4dff-8728-9dbef0276e2e","resolution":{"observed_at":"2026-08-06T00:29:57.468919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12345","last_updated":"2023-11-21T04:38:21Z","snapshot_observed_at":"2026-08-10T13:51:19.253171Z","submitted_at":"2023-11-21T04:38:21Z","title":"Stable Diffusion For Aerial Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12345","snapshot_observed_at":"2026-08-06T00:29:57.573900Z","title":"AvalonBench: Evaluating LLMs Playing the Game of Avalon,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.573900Z"},"links":{"cited_paper":"/paper/2311.12345","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:59f18d9b802689fd0a17ffa0b97305118c2ee63b53dcf5a52adf2fa88259a138","observation_id":"891d8d25-88bf-48f7-bdc6-ff1dad7283dc","resolution":{"observed_at":"2026-08-06T00:29:57.573900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01987","last_updated":"2025-02-04T04:02:58Z","snapshot_observed_at":"2026-08-10T07:05:12.352056Z","submitted_at":"2025-02-04T04:02:58Z","title":"Online Adaptive Traversability Estimation through Interaction for Unstructured, Densely Vegetated Environments","version":1},"cited_work":{"arxiv_id":"2502.01987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01987","snapshot_observed_at":"2026-08-06T00:29:58.983569Z","title":"Online Adaptive Traversability Estimation through Interaction for Unstructured, Densely Vegetated Environments","venue":"cs.RO","work_id":"3bfc1b21-5d31-4bd5-bf0a-b333c42e0ed5","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.693775Z"},"links":{"cited_paper":"/paper/2502.01987","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:0e75543148d3ee251957994c4daa1639795f64dc9ac7d59264e462b39a0ad2e9","observation_id":"dc053066-a483-4ae5-860e-62584c6b65a2","resolution":{"observed_at":"2026-08-06T00:29:59.083036Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13137","last_updated":"2025-05-19T14:07:36Z","snapshot_observed_at":"2026-08-07T15:43:12.396456Z","submitted_at":"2025-05-19T14:07:36Z","title":"Learning to Adapt to Position Bias in Vision Transformer Classifiers","version":1},"cited_work":{"arxiv_id":"2505.13137","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13137","snapshot_observed_at":"2026-08-06T00:29:58.860214Z","title":"Learning to Adapt to Position Bias in Vision Transformer Classifiers","venue":"cs.CV","work_id":"d9e7ccbf-e63f-4cbc-9663-7e5e9048cda0","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.773801Z"},"links":{"cited_paper":"/paper/2505.13137","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:0f785ec032b6b97f032710253396f44b4f4668ee1d1641005b0f12768aa36603","observation_id":"3974ba24-355a-435e-8cb6-3c8a78a87e94","resolution":{"observed_at":"2026-08-06T00:29:58.912857Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11241","last_updated":"2025-03-14T09:46:05Z","snapshot_observed_at":"2026-08-10T07:49:17.296587Z","submitted_at":"2025-03-14T09:46:05Z","title":"Compound Expression Recognition via Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2503.11241","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.11241","snapshot_observed_at":"2026-08-06T00:29:58.736431Z","title":"Compound Expression Recognition via Large Vision-Language Models","venue":"cs.CV","work_id":"06e93c63-b384-4012-87ff-1161d246b37d","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.020373Z"},"links":{"cited_paper":"/paper/2503.11241","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:bfcc87e49040aa6fbd1fe18975d0c7ce02e4417954daf9ba5cc8030311063dce","observation_id":"ca0e29d1-e053-4708-b07e-129e648b92ac","resolution":{"observed_at":"2026-08-06T00:29:58.788800Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12589","last_updated":"2025-03-16T17:49:07Z","snapshot_observed_at":"2026-08-07T17:00:21.219405Z","submitted_at":"2025-03-16T17:49:07Z","title":"Context-Aware Two-Step Training Scheme for Domain Invariant Speech Separation","version":1},"cited_work":{"arxiv_id":"2503.12589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.12589","snapshot_observed_at":"2026-08-06T00:29:58.519869Z","title":"Context-Aware Two-Step Training Scheme for Domain Invariant Speech Separation","venue":"cs.SD","work_id":"dd836cb3-2bc0-46ce-9639-7418bac7a293","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.108401Z"},"links":{"cited_paper":"/paper/2503.12589","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:61bd9275226036536d45837227bbc45a190b4a51c20e211218a9e92370e3c28f","observation_id":"b455f210-342a-402c-a79c-e6bb5e790e4b","resolution":{"observed_at":"2026-08-06T00:29:58.622840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00787","last_updated":"2024-09-01T17:40:04Z","snapshot_observed_at":"2026-08-09T22:54:13.194666Z","submitted_at":"2024-09-01T17:40:04Z","title":"The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00787","snapshot_observed_at":"2026-08-06T00:29:58.203660Z","title":"CoP: Agentic Red-teaming for Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.203660Z"},"links":{"cited_paper":"/paper/2409.00787","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:3471dba70dae3fa08e8a1d53380271d307000c1509740430262ff751a53291c4","observation_id":"5a58fb64-3080-4b1b-b706-afef034d9e26","resolution":{"observed_at":"2026-08-06T00:29:58.203660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09865","last_updated":"2025-01-16T22:29:12Z","snapshot_observed_at":"2026-08-03T13:08:30.296039Z","submitted_at":"2025-01-16T22:29:12Z","title":"Lower bounds on the $\\ell$-rank of ideal class groups","version":1},"cited_work":{"arxiv_id":"2501.09865","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09865","snapshot_observed_at":"2026-08-06T00:29:58.382649Z","title":"Lower bounds on the $\\ell$-rank of ideal class groups","venue":"math.NT","work_id":"ea3dcc0f-48c6-4ae5-b5cd-229afe81f5a8","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.290673Z"},"links":{"cited_paper":"/paper/2501.09865","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f109133c35139aacc14aa13021b2746f7270c15d1ebbe6899b2af5a5b747b52b","observation_id":"d7788856-23e0-4090-9d8f-4f6cd1ed82a9","resolution":{"observed_at":"2026-08-06T00:29:58.420619Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01942","last_updated":"2024-08-29T05:48:42Z","snapshot_observed_at":"2026-07-06T17:39:07.926765Z","submitted_at":"2024-03-04T11:24:51Z","title":"Mitigating Label Noise on Graph via Topological Sample Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01942","snapshot_observed_at":"2026-08-06T00:29:57.946969Z","title":"Available: https://arxiv.org/abs/2403.01942","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.946969Z"},"links":{"cited_paper":"/paper/2403.01942","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:b176ba809642d95382b763e186c2e7a1593a61397b20f450fab386775bfdcc78","observation_id":"58b5660d-6260-46e1-908c-065a195af10c","resolution":{"observed_at":"2026-08-06T00:29:57.946969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17458","last_updated":"2026-04-20T03:53:49Z","snapshot_observed_at":"2026-07-06T22:17:26.368596Z","submitted_at":"2025-08-24T17:26:58Z","title":"Evaluating the Impact of Verbal Multiword Expressions on Machine Translation","version":2},"cited_work":{"arxiv_id":"2508.17458","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17458","snapshot_observed_at":"2026-08-06T00:29:59.343799Z","title":"Evaluating the Impact of Verbal Multiword Expressions on Machine Translation","venue":"cs.CL","work_id":"5bd557c6-303d-4f54-a51f-163c52c6ab99","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.241797Z"},"links":{"cited_paper":"/paper/2508.17458","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:04f9b2670748d3d6c6803453a696947cdd8996db9b14a771821dc71de7889b7e","observation_id":"d839405d-1902-4356-b701-0d250ea816f7","resolution":{"observed_at":"2026-08-06T00:29:59.419281Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T00:04:44.793928Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2608.03166."}