{"as_of":"2026-08-16T01:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:254eb63226042f504693804927ff96c93416a2d1e75a48c5b686650c9acd05df","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T20:55:21.031591Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06807/citation-record","integrity":"/paper/2607.06807/integrity","json":"/paper/2607.06807/citation-record.json","paper":"/paper/2607.06807"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:077310e4f3c08ab42b0be94ce130e116a08eba5e787349fe15588b80fbfeb43a","observation_id":"96788680-c4c1-4db7-8808-e02a60b70f6c","resolution":{"observed_at":"2026-07-10T20:57:34.995323Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:731c740b4531136965d0e50746570af4608bc069f129bb80a9c20b313c49c359","observation_id":"ac7258ce-13a5-4b1f-afb2-b9be6f1ba4c1","resolution":{"observed_at":"2026-07-10T20:57:35.029686Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:74c248519698dba244da3331b62e53b685fb2730d1d5354d83a4676661fce913","observation_id":"b276e316-fdb6-4c6d-98ae-cc019be49b72","resolution":{"observed_at":"2026-07-10T20:57:34.828909Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.946557Z","title":"Frontiers of Computer Science , volume=","venue":null,"work_id":"2f3cc25b-7c92-44cd-b5f3-cb7712fc7b22","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:e005605d0607f26568131c05ea8e3dabab8228e90ce9267a6c3b2972464a135b","observation_id":"ff2b41a1-8d09-4d1d-b67a-523acb272037","resolution":{"observed_at":"2026-07-10T20:57:35.968241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.896389Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"d0a9eb97-b28b-45a3-9985-851d90319035","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:a856542a97e3fea8b8f20d4ec13e2872019ac5174ad2c632a28a427b3f8315b5","observation_id":"d3be19a4-7216-4ba6-a281-2919442ef2e2","resolution":{"observed_at":"2026-07-10T20:57:35.914835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.917138Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"4a8bfb2f-6555-4986-99cd-393a2d8e02d6","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:d79865e51589413a647661a129c70a594ba0aacea31354c7fb05434152543597","observation_id":"87a92a94-adc6-4ae9-a189-0a8493770a5c","resolution":{"observed_at":"2026-07-10T20:57:35.937825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.513820Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":"8616d356-a99c-41f6-ab2f-06d2a9af570d","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:549e8d7bd4b49cece3f2cb969a0841a8ceaf3cebbe4246dec0bcc6177ac70df9","observation_id":"cbc9cc4c-73a1-4fc3-8b88-e49e4362b092","resolution":{"observed_at":"2026-07-10T20:57:35.537088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07155","last_updated":"2025-03-17T00:22:42Z","snapshot_observed_at":"2026-08-12T23:45:40.571822Z","submitted_at":"2024-06-11T11:02:04Z","title":"Scaling Large Language Model-based Multi-Agent Collaboration","version":3},"cited_work":{"arxiv_id":"2406.07155","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07155","snapshot_observed_at":"2026-07-10T20:57:34.565736Z","title":"Yu Shang et al","venue":"cs.AI","work_id":"8c6b62a4-4ade-4a58-958c-9035f4524b6e","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2406.07155","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:7a6fdd8816e384cd9712d9c98b444dec1cea73bf313f599736ba6b83f6c58780","observation_id":"6bfcbace-c70b-442f-a65c-aed5ad95e5ba","resolution":{"observed_at":"2026-07-10T20:57:34.580097Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.632870Z","title":"author=","venue":null,"work_id":"0930a90d-19f0-41ba-9668-f983a65aa8e6","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:df612ab4a46c083dcf24cc6935adeb023b622a75abe41087cf9539a084e99c2c","observation_id":"4b0e31d7-37d7-4263-b851-d33160c57eae","resolution":{"observed_at":"2026-07-10T20:57:35.652640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.204686Z","title":"Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining V","venue":null,"work_id":"cb50c559-955e-4be0-8dfe-cc8abd3d636e","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:67ea064159f2910b3298cd70ab8abd8acf530350c7117ed48e4f7d84ab4f0a4f","observation_id":"2957c9cd-ab30-4d67-85c2-1c1fcf7162b1","resolution":{"observed_at":"2026-07-10T20:57:36.220087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.214170Z","title":"2025 IEEE Conference on Secure and Trustworthy Machine Learning (SaTML) , pages=","venue":null,"work_id":"0b9b8e81-3121-42b2-99f6-d5390c7e30dc","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:77e01601feb0992a608e9f7c1a376371e5c0d4c50931c6894eba94dfb3d9a6d6","observation_id":"b985f25c-b7c3-46ca-9007-06eadf48fdb2","resolution":{"observed_at":"2026-07-10T20:57:36.229297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-15T16:37:22.396444Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":"2311.03191","doi":"10.48550/arxiv.2311.03191","metadata_source":"pith","pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","venue":"cs.LG","work_id":"5ab14a22-d25d-4d5f-8b1e-f2ff79daf69d","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:81674c291944c119152e0a8dd6fa7d8f855b2d94d7e6071249510e5921c49c64","observation_id":"fbf3cfad-54c3-4069-871a-63b61fc40a6a","resolution":{"observed_at":"2026-07-10T20:57:34.622539Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.949745Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"876747a1-add1-4112-b7ee-eab2b90f878b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:e9605b878950b3a2d5686aa6295e9710e01f24f102bcd6e1fc779dcd83b47e4f","observation_id":"5ab3aae1-2637-44a4-9263-91c0d68b1018","resolution":{"observed_at":"2026-07-10T20:57:35.969333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18948","last_updated":"2025-08-29T06:03:42Z","snapshot_observed_at":"2026-08-15T06:21:38.235121Z","submitted_at":"2024-11-28T06:29:46Z","title":"RevPRAG: Revealing Poisoning Attacks in Retrieval-Augmented Generation through LLM Activation Analysis","version":5},"cited_work":{"arxiv_id":"2411.18948","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.18948","snapshot_observed_at":"2026-07-10T20:57:34.959834Z","title":"11 Florian Tramèr, Nicholas Carlini, Wieland Brendel, Aleksander Madry, Alexey Kurakin, and Nico- las Papernot","venue":"cs.CR","work_id":"3a5be880-4072-42a5-9135-b55e2a0e6826","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2411.18948","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:1e3ac5d807684ad207788511e8178cde4875b903cec13f453c3459149c78ac1e","observation_id":"a6478b69-8110-4f00-9e8e-b95600c45bc3","resolution":{"observed_at":"2026-07-10T20:57:34.974946Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.973848Z","title":"Findings of the Association for Computational Linguistics ACL 2024 , pages=","venue":null,"work_id":"5b986cb8-0194-449e-9611-900d9c31f267","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:345b40a52cdd73398142a1e90ef08da4f7b812a1d6bab70a23e5a42e0d12985b","observation_id":"e57bf030-f21d-445d-82d9-05dc65abec5c","resolution":{"observed_at":"2026-07-10T20:57:36.000678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.878672Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"fa4bad01-f3c7-4c7e-91f0-3fd9ac642bc8","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:477ffc5e0e6bcbc4d3fabf6657e5f45e3c77dc9203e84c82a6c773a936820625","observation_id":"a19b7883-5357-4b5f-a4de-341be8b0f687","resolution":{"observed_at":"2026-07-10T20:57:35.895527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00799","last_updated":"2025-03-06T17:43:10Z","snapshot_observed_at":"2026-08-14T07:43:15.497304Z","submitted_at":"2024-06-02T16:53:21Z","title":"Get my drift? Catching LLM Task Drift with Activation Deltas","version":6},"cited_work":{"arxiv_id":"2406.00799","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.00799","snapshot_observed_at":"2026-07-10T20:57:34.835399Z","title":"Are you still on track!? catching LLM task drift with activations","venue":"cs.CR","work_id":"f913aa64-dddb-4ce5-9f2c-5e314589aa1a","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2406.00799","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c499618b13f4a0bd8ae718efbcd0a7b7dc82f74a5121f9853355b5c69c1aec62","observation_id":"4378fb33-7fba-4141-8afe-b42e1254040a","resolution":{"observed_at":"2026-07-10T20:57:34.851213Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.897824Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"f6849288-6909-4838-8583-44e46a1f962b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:3d87014d09bae16f63cf5471534b0cf3fdb1205d2942191ceea4c07b9f6505d6","observation_id":"84cdd8e4-2e1a-4b30-8360-17e31f7ae762","resolution":{"observed_at":"2026-07-10T20:57:35.919538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07557","last_updated":"2025-02-11T13:50:50Z","snapshot_observed_at":"2026-08-11T19:18:54.639349Z","submitted_at":"2025-02-11T13:50:50Z","title":"JBShield: Defending Large Language Models from Jailbreak Attacks through Activated Concept Analysis and Manipulation","version":1},"cited_work":{"arxiv_id":"2502.07557","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07557","snapshot_observed_at":"2026-07-10T20:57:34.899802Z","title":"Jbshield: Defending large language models from jailbreak attacks through activated concept anal- ysis and manipulation.arXiv preprint arXiv:2502.07557","venue":"cs.CR","work_id":"1a9c517d-7eb4-4ab2-baf5-aa7c21bfefac","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2502.07557","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:4052e353e15d3ca416e409142914e95bb838541ad9bd35611d622ff094245264","observation_id":"e6e9c041-3718-4108-b816-5722b6a777f5","resolution":{"observed_at":"2026-07-10T20:57:34.916124Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.922952Z","title":null,"venue":null,"work_id":"39bef275-0cda-45d0-9e19-0da4a496e32f","year":2019},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:f289606491d3cd4aa21ba81d35514792c0c89ed1b328ab310b9c4323f355f21a","observation_id":"d3520720-f9ab-4df1-9c89-01ffc474de57","resolution":{"observed_at":"2026-07-10T20:57:35.945343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:794b086673969bf1aa007c7a3ff6894acc4106b1b902abb8037f29af58b41014","observation_id":"fe3a04f6-c054-4b93-a85e-4153e2764802","resolution":{"observed_at":"2026-07-10T20:57:34.602027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.07675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:34.920017Z","title":"DynTaskMAS : A dynamic task graph-driven framework for asynchronous and parallel LLM -based multi-agent systems","venue":null,"work_id":"46ab1588-2309-463c-a23f-2b981d37349d","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:aae0f86f8a42ece78e0e34cb4f54718480b9c803c7fa020be9aa11ede76801dc","observation_id":"46fca5ae-73f9-4b92-aa0a-047196f9be9c","resolution":{"observed_at":"2026-07-10T20:57:34.936792Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.706094Z","title":"Proceedings of the 2018 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"b8274e43-cc96-4d74-9434-90fc49873206","year":2018},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c9b67d37bafcce97173b4f28d291523071d16b902c1f4c8192b5931ff649d904","observation_id":"a8d4ac11-f435-43a4-9d19-38ded621310a","resolution":{"observed_at":"2026-07-10T20:57:35.723234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.459358Z","title":"2024 , howpublished=","venue":null,"work_id":"6134694d-3871-4383-81fc-600ef8f73761","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:1dc95787d008cab2a83b2fda3bbcf744b5ca00b5a5dddb9023f30de667ad4891","observation_id":"8bda52b4-e1b4-4c1a-97ea-5d1310db6adc","resolution":{"observed_at":"2026-07-10T20:57:35.482312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.165083Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"6cfd3349-bd29-48cd-b95c-cada462b7211","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:744360b1d30ee7e576a8a77bb4873cce504a102b53afb432f52e21d279981a2d","observation_id":"5f5c1104-68af-46c4-bea8-72f9b4890319","resolution":{"observed_at":"2026-07-10T20:57:36.181817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.794329Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"18debcf5-7bad-4020-b38c-024a60edea78","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:9960be6f889e9f1dd0ed5fe6e305b27fa8855473bd1cd562c76f0f9586828883","observation_id":"ccce45c3-51d7-4d18-99ba-10bb5371be01","resolution":{"observed_at":"2026-07-10T20:57:35.810777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04445","last_updated":"2026-04-21T10:38:10Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-02-23T21:57:27Z","title":"Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey","version":2},"cited_work":{"arxiv_id":"2603.04445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.04445","snapshot_observed_at":"2026-07-10T20:57:34.855543Z","title":"Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey","venue":"cs.NI","work_id":"194d3c1f-5d07-497d-be5e-3c74b61f1a0f","year":2026},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2603.04445","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6e6c07a421cd07872299be36f07f48e8b0cbe95b3fc2393f81dd17e6159770db","observation_id":"6f4e7cd1-3f79-46e1-8ab2-e935cf7c5ff1","resolution":{"observed_at":"2026-07-10T20:57:34.883304Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-08-16T00:08:23.767909Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":"2406.18665","doi":"10.48550/arxiv.2406.18665","metadata_source":"pith","pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","venue":"cs.LG","work_id":"f6b91d8a-ce78-4b5e-9dae-6dd8a22cc087","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:323b944f960e615b49f2a926daeb98eabe46a3ebab1b951091486fd0bb02e498","observation_id":"772890eb-75f7-4074-9888-d8b4b0e57a91","resolution":{"observed_at":"2026-07-10T20:57:34.947178Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T07:08:14.190615+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T07:08:14.190615+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T07:08:14.190615+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-08-10T11:59:11.481480Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":"2305.05176","doi":"10.48550/arxiv.2305.05176","metadata_source":"pith","pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","venue":"cs.LG","work_id":"5c567414-35de-4373-ae7a-1790da594e8d","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:a4b76a3cdb598902c5604adba7601ac8ecbc9ba95e64719ef2cbd8ecc4542c29","observation_id":"93aa2cbc-5f67-4cc9-a142-67b536c7c75b","resolution":{"observed_at":"2026-07-10T20:57:34.673701Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T07:08:14.020381+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T07:08:14.020381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T07:08:14.020381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.577399Z","title":"Machine learning , volume=","venue":null,"work_id":"3d15587f-4297-434c-b45a-cdec650baaba","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:39aacc3f88edc377454a1152f8ae21df2403495de59b4dcaad3a20b9c3f640eb","observation_id":"ad429d00-f485-4bdb-85ab-4adfe68a762a","resolution":{"observed_at":"2026-07-10T20:57:35.603546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.196512Z","title":"Computers & Security , volume=","venue":null,"work_id":"5a073f48-b30e-4e1b-a6c1-37a8a562770e","year":2022},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:fadf421509a2c62bb98b624896d204fc51dcb3d5289e025e61af5807ab0dd291","observation_id":"639dbf85-d9cd-4cc5-981a-a0dd4faf9943","resolution":{"observed_at":"2026-07-10T20:57:36.211960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.486358Z","title":"European Conference on Information Retrieval , pages=","venue":null,"work_id":"2ef074f8-0ee3-476e-a0fb-9ba894637180","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:190806c2c03383f3422df7aa65cd22982036cb00a9630fc6086bfa11b64f7964","observation_id":"32180d9f-8008-4054-9028-bda119840acf","resolution":{"observed_at":"2026-07-10T20:57:35.518444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:53414d9184ae1475cbebe8c9144186d49067ae5380a3853f783850ad249afa9c","observation_id":"97a1f0f7-707b-419b-8870-b25bef562b49","resolution":{"observed_at":"2026-07-10T20:57:34.578609Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c6b087d6c92abfaa90dd8040db1aaac807f3e2e7d92e5a79dde08510d05e7b00","observation_id":"eb085aae-4de5-42e9-88d6-c0a71186b60e","resolution":{"observed_at":"2026-07-10T20:57:34.716115Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-14T02:46:12.121034Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:e729ca9976150ce1b35553a73ce905bdb13a57dd78bc499e2e9cd227510af90f","observation_id":"5007da1d-d93f-4207-ade5-9b27fc54f98c","resolution":{"observed_at":"2026-07-10T20:57:34.732983Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.878354Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"60b3dfff-03ce-41f6-af51-f6dd6de3f1d9","year":2018},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:f48a447a55d40695da53ec16f6e25759efed8bcb6c763c16acf2ed636d22e3ad","observation_id":"1f0dbe6e-48ba-411c-b5aa-3e00b93800f4","resolution":{"observed_at":"2026-07-10T20:57:35.894048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.03704","doi":"10.48550/arxiv.2503.03704","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yann Dubois, Balázs Galambosi, Percy Liang, and Tat- sunori B Hashimoto","venue":"arXiv (Cornell University)","work_id":"cc008b41-0943-47c8-81e7-bafb5beac6ce","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ac44c80e7ea6c3b3546e870836586edad47ed39e8da8200d61ff31f15c756fea","observation_id":"59c9a12f-7d7b-4c49-b161-f9a441c4f900","resolution":{"observed_at":"2026-07-10T20:57:34.618765Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.995970Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"7b1cccae-5687-44cd-bf57-16c4e754af68","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:67e94de2a766044c95ad0e0ff08ebd4c60df93031770529d8b21c1f47040c6d7","observation_id":"8498b9a2-783a-42af-a588-a4f42146d381","resolution":{"observed_at":"2026-07-10T20:57:36.021153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":"1908.10084","doi":"10.48550/arxiv.1908.10084","metadata_source":"pith","pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","venue":"cs.CL","work_id":"27adfcc9-2a67-43d6-a844-78309012411f","year":2019},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:0605703ba93a2f5c823e355354190cef0d5709389434c7e760531c64b7692e5b","observation_id":"a4f8249c-778a-4485-b6fd-04502f4c4d7d","resolution":{"observed_at":"2026-07-10T20:57:34.831848Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-12T06:19:15.148899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T06:19:15.148899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.777330Z","title":"CoRR , year=","venue":null,"work_id":"f58ca98c-1964-40d0-ac6c-90c96bc25c50","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:2d23943f1ec7aee982e8e2172c6e44821686b18d9438d68f2f6b9499b8f34af2","observation_id":"bc218119-2b26-42b5-b438-2785c361117b","resolution":{"observed_at":"2026-07-10T20:57:35.791875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08127","last_updated":"2026-04-25T05:20:29Z","snapshot_observed_at":"2026-08-15T00:37:43.532403Z","submitted_at":"2025-08-11T16:04:47Z","title":"BlindGuard: Safeguarding LLM-based Multi-Agent Systems under Unknown Attacks","version":2},"cited_work":{"arxiv_id":"2508.08127","doi":"10.48550/arxiv.2508.08127","metadata_source":"pith","pith_arxiv_id":"2508.08127","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"BlindGuard: Safeguarding LLM-based Multi-Agent Systems under Unknown Attacks","venue":"cs.AI","work_id":"1267acfe-e53b-4c7d-9316-49d0ab6b59ce","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2508.08127","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:4ea8a1fefe470febe815159588d187021859c8b8dd8f42c9480c6eb000b0c46e","observation_id":"353d667a-60b1-40a1-9553-c806d75f3ee2","resolution":{"observed_at":"2026-07-10T20:57:34.895863Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07283","last_updated":"2024-10-09T11:01:29Z","snapshot_observed_at":"2026-08-11T20:32:18.138792Z","submitted_at":"2024-10-09T11:01:29Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2410.07283","doi":"10.48550/arxiv.2410.07283","metadata_source":"pith","pith_arxiv_id":"2410.07283","snapshot_observed_at":"2026-07-10T20:57:34.951275Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","venue":"cs.MA","work_id":"17359a70-8c04-4709-a6db-aa38995d867e","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2410.07283","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8d98b8b26d295143c4385db54f44e33d21cdb53ea380be9c196ad40535abe256","observation_id":"3ad51200-cecc-4b01-9970-597a8073d419","resolution":{"observed_at":"2026-07-10T20:57:34.967267Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:34.441537+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:34.441537+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.746605Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"93b48608-4532-44cd-ae12-5357c8fb17d6","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:9a46afff772b209fd6bf6c631e6525135f2699b1c06b63b7867071cc793f90b2","observation_id":"0c45dc3c-de5d-4392-bb25-9cb66b9c5988","resolution":{"observed_at":"2026-07-10T20:57:35.761375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05605","last_updated":"2025-04-08T01:36:16Z","snapshot_observed_at":"2026-08-02T05:27:21.658804Z","submitted_at":"2025-04-08T01:36:16Z","title":"ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs","version":1},"cited_work":{"arxiv_id":"2504.05605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.05605","snapshot_observed_at":"2026-07-10T20:57:34.661760Z","title":"ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs","venue":"cs.CR","work_id":"20528232-9520-471b-b7b9-da677c306462","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2504.05605","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:897ab433d7673ff954deb903fe654f9cafac31f727f3e5bd6e3a11588e374f7e","observation_id":"6158eaf3-4304-489f-9535-a3edfadc9e6f","resolution":{"observed_at":"2026-07-10T20:57:34.676550Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15686","last_updated":"2024-10-21T06:54:27Z","snapshot_observed_at":"2026-08-13T15:05:19.929324Z","submitted_at":"2024-10-21T06:54:27Z","title":"NetSafe: Exploring the Topological Safety of Multi-agent Networks","version":1},"cited_work":{"arxiv_id":"2410.15686","doi":"10.48550/arxiv.2410.15686","metadata_source":"pith","pith_arxiv_id":"2410.15686","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Netsafe: Exploring the topological safety of multi- agent networks","venue":"cs.MA","work_id":"e1f9e23e-4c0a-423c-83e3-6537a32548dc","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2410.15686","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:b80ad15e79e4bf2dae46c4405eb792c026c1040fca01dab011d45b4b5ab9fc8e","observation_id":"7952af6e-b8fc-4efd-b145-9f88c424643d","resolution":{"observed_at":"2026-07-10T20:57:34.955947Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04392","last_updated":"2025-07-08T04:14:01Z","snapshot_observed_at":"2026-08-07T17:24:54.525086Z","submitted_at":"2025-03-06T12:41:54Z","title":"AgentSafe: Safeguarding Large Language Model-based Multi-agent Systems via Hierarchical Data Management","version":2},"cited_work":{"arxiv_id":"2503.04392","doi":"10.48550/arxiv.2503.04392","metadata_source":"pith","pith_arxiv_id":"2503.04392","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentsafe: Safeguarding large language model-based multi- agent systems via hierarchical data management","venue":"cs.AI","work_id":"63b48ec2-507c-4b82-940a-c1d2a2372c47","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2503.04392","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:233f74691845e0adf4b107cbc7eb992b6d321e5d3c6117195aea841fec23bba0","observation_id":"98530c8e-0028-407a-97b7-c06aef7814a6","resolution":{"observed_at":"2026-07-10T20:57:35.010016Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02546","last_updated":"2026-04-14T05:32:17Z","snapshot_observed_at":"2026-08-13T01:30:06.203819Z","submitted_at":"2025-06-03T07:32:57Z","title":"To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems","version":2},"cited_work":{"arxiv_id":"2506.02546","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02546","snapshot_observed_at":"2026-07-10T20:57:34.696561Z","title":"To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems","venue":"cs.CR","work_id":"fb0a3a3a-36fc-408f-b1ce-8ea6fa03f08b","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2506.02546","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:9f1580d337301db53a94a0aa9471ab42b6e57fd13e69d02b6b4e25f8667f5060","observation_id":"6bf9402b-c279-4327-8b45-60adb90a03de","resolution":{"observed_at":"2026-07-10T20:57:34.711526Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02691","last_updated":"2024-08-04T04:52:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-05T06:21:45Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","version":3},"cited_work":{"arxiv_id":"2403.02691","doi":"10.1145/3696410.3714756","metadata_source":"pith","pith_arxiv_id":"2403.02691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","venue":"cs.CL","work_id":"5cbfcda4-ec26-44e4-be60-e1525956d71d","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2403.02691","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:26550d68d9ad03b5e62fe4cb5151959d795f1d476d06ba71a657476c95d11405","observation_id":"93a17037-9778-4e16-9707-cf053bf1762b","resolution":{"observed_at":"2026-07-10T20:57:34.477702Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.836721Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages=","venue":null,"work_id":"10e93277-28fe-40ad-a208-fa71bec9d4fc","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8956510346d6171861e7a01aab65ec4a8cd43c11317266559b38d9b6f363011a","observation_id":"321f68f8-c1a3-4cef-8c88-dbd02a0ef42f","resolution":{"observed_at":"2026-07-10T20:57:35.857734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.153938Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"39654060-3c03-42af-9e57-f5189eb6bfce","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:5f634ff41c9b2e6b9081f0979d85232e6cb9ebcdbef35a7ffca1032a139b7119","observation_id":"365bbf48-02d5-46f0-a15b-2f4c58dec515","resolution":{"observed_at":"2026-07-10T20:57:36.174160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14859","last_updated":"2024-06-03T03:29:07Z","snapshot_observed_at":"2026-08-13T04:14:09.071135Z","submitted_at":"2024-02-20T23:08:21Z","title":"The Wolf Within: Covert Injection of Malice into MLLM Societies via an MLLM Operative","version":2},"cited_work":{"arxiv_id":"2402.14859","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.14859","snapshot_observed_at":"2026-07-10T20:57:34.775593Z","title":"The Wolf Within: Covert Injection of Malice into MLLM Societies via an MLLM Operative","venue":"cs.CR","work_id":"849458c0-eae1-4e87-81d5-a6d056d48129","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2402.14859","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:42c4a9f6063f3c15671b26a388d29186cefb267bcc45f1726d0e5f8afa74b626","observation_id":"6ac94365-f39f-404a-9f39-e5e449603e18","resolution":{"observed_at":"2026-07-10T20:57:34.794177Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.678235Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":"f640491e-2dfe-4c1a-9f75-2c2485da1bc4","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:df820af6a1f401445df4ea4b67a87ecbe3a662733e4b801f4c347baf312274ca","observation_id":"85d9a114-59d5-43d3-84df-2809fe9704a6","resolution":{"observed_at":"2026-07-10T20:57:35.693133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18572","last_updated":"2025-05-24T07:24:29Z","snapshot_observed_at":"2026-08-14T07:42:32.308312Z","submitted_at":"2025-05-24T07:24:29Z","title":"MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures -- A Comprehensive Framework","version":1},"cited_work":{"arxiv_id":"2505.18572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18572","snapshot_observed_at":"2026-07-10T20:57:34.404122Z","title":"MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures -- A Comprehensive Framework","venue":"cs.MA","work_id":"0f86285a-df53-4764-9ae0-4069e0769e01","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2505.18572","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:b4a45afb7ba45557c3dcc38e427d0ea118deb6acdee9c00514e6747bf1942f57","observation_id":"781349bf-0d3e-448f-853e-5b81caaf5c90","resolution":{"observed_at":"2026-07-10T20:57:34.420095Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14529","last_updated":"2025-02-20T13:02:00Z","snapshot_observed_at":"2026-08-07T18:02:05.606032Z","submitted_at":"2025-02-20T13:02:00Z","title":"CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models","version":1},"cited_work":{"arxiv_id":"2502.14529","doi":"10.48550/arxiv.2502.14529","metadata_source":"pith","pith_arxiv_id":"2502.14529","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Corba: Contagious recursive blocking attacks on multi- agent systems based on large language models","venue":"cs.CL","work_id":"17edf756-49eb-4862-9f9c-c8637e59173c","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2502.14529","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:5594c7f68fa8a7a0fd2389070b542debcc3f334a4201d55acf66770c4ebba669","observation_id":"6660901d-8185-4d8e-98a3-eb2e2e5497c2","resolution":{"observed_at":"2026-07-10T20:57:34.516433Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.00218","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:34.971136Z","title":"arXiv preprint arXiv:2504.00218 , year=","venue":null,"work_id":"a1ead14c-ace3-4c4f-9f03-25915ca48302","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ee800e4f6b16cf1959e0ba5c6d3a9ef11a2dad6c7047eed29892c1fd169d8d3b","observation_id":"0b5adbac-d96e-40f3-9d41-9199e0a12384","resolution":{"observed_at":"2026-07-10T20:57:34.986010Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11855","last_updated":"2024-02-02T08:28:01Z","snapshot_observed_at":"2026-08-13T05:21:50.184758Z","submitted_at":"2023-11-20T15:50:09Z","title":"Evil Geniuses: Delving into the Safety of LLM-based Agents","version":2},"cited_work":{"arxiv_id":"2311.11855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.11855","snapshot_observed_at":"2026-07-10T20:57:34.626195Z","title":"Evil geniuses: Delving into the safety of llm-based agents","venue":"cs.CL","work_id":"e13aaabf-88ce-407e-8517-ac57b98525d5","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2311.11855","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:f555c3da493d019d71c6163694192ae43837973252bc18053334838005c5d96e","observation_id":"e97679e3-2fbd-4dbb-9ea3-8b1432a727d3","resolution":{"observed_at":"2026-07-10T20:57:34.640349Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-07-06T15:40:27.639368Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":"2306.05499","doi":"10.48550/arxiv.2306.05499","metadata_source":"pith","pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Prompt Injection attack against LLM-integrated Applications","venue":"cs.CR","work_id":"977b4683-bba6-49d6-8f3d-496c41cb7fac","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:b43c54161e68e1e9edeac29ba677c756a3aa2e8244432e03e41e5f66b5c29c5e","observation_id":"4757c623-4dc7-40e2-9b41-1c2f4c92c554","resolution":{"observed_at":"2026-07-10T20:57:34.791596Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.726030Z","title":"First Conference on Language Modeling , year=","venue":null,"work_id":"9f93e065-7c5f-4d0b-9f39-cbbfbcc40246","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:66c94f5b9889e297cbd9dbd129bd34bf8718dee83b9269b77bdc1a8ae3d40a2f","observation_id":"e7c56370-d53c-496a-a2c0-1cccdb746ec2","resolution":{"observed_at":"2026-07-10T20:57:35.741634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03314","last_updated":"2023-06-05T23:55:37Z","snapshot_observed_at":"2026-08-11T04:53:44.472967Z","submitted_at":"2023-06-05T23:55:37Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","version":1},"cited_work":{"arxiv_id":"2306.03314","doi":"10.48550/arxiv.2306.03314","metadata_source":"pith","pith_arxiv_id":"2306.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","venue":"cs.AI","work_id":"6ed8494c-c488-407e-b9c0-61e9a411ce26","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2306.03314","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:3872595503ba66c5959c1fe03f21127f73da7aea8df0deddcd1357c8527ebfd8","observation_id":"5da83382-3df8-4c5a-aaf7-c5aa91567828","resolution":{"observed_at":"2026-07-10T20:57:34.378672Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.184806Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"0d31ce7e-f193-44c7-8214-dfb8eb3f9c3d","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:061eac26bc35e6347a9a7cefcaac65f964b5196e361e60084af13ad3eefc9c65","observation_id":"dcbf6041-11e0-4685-86eb-13feedf545d8","resolution":{"observed_at":"2026-07-10T20:57:36.201393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.082879Z","title":null,"venue":null,"work_id":"c03e1081-b952-48b6-952a-a137c830f973","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c74ff51d8bb5a610aedbe9c0b7187e726baa3c883769a9e59c9170b7a4bf05c2","observation_id":"c18d4442-0df3-4f2c-97e6-b9dea02779ee","resolution":{"observed_at":"2026-07-10T20:57:36.101515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.798971Z","title":null,"venue":null,"work_id":"c66125cc-4749-4908-8155-a2f126bf7fce","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:398b46098e1c441e1639e49b0bbdc7116466225989b6dc8c47900c5547f460f8","observation_id":"5a59725c-5db6-4df6-8a3d-29cf77131395","resolution":{"observed_at":"2026-07-10T20:57:35.812605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17161","last_updated":"2024-02-27T02:47:50Z","snapshot_observed_at":"2026-08-13T04:09:31.939200Z","submitted_at":"2024-02-27T02:47:50Z","title":"Large Language Model for Participatory Urban Planning","version":1},"cited_work":{"arxiv_id":"2402.17161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.17161","snapshot_observed_at":"2026-07-10T20:57:34.643826Z","title":"Large language model for participatory urban planning","venue":"cs.AI","work_id":"f2f4782b-7239-4f8b-a03c-bd1ced17bce8","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2402.17161","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:32a9144d75777f7863ceab72677c1fec531f57e86bd2b1154e9448c114edd44e","observation_id":"e6bab736-a335-4b58-af68-e75101e2c6f4","resolution":{"observed_at":"2026-07-10T20:57:34.658027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.715926Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":"a6f2c101-ced5-453b-9e8c-36c4fd9551b1","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:042ed3df65354fba2d4dda1244e79519b41f93025d9e315ec7127341d649aba0","observation_id":"46ff4a73-d4c3-400b-a725-a5d50027237c","resolution":{"observed_at":"2026-07-10T20:57:35.732928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.128533Z","title":"Proceedings of the 2024 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"3afc4370-e8bd-4492-b99c-5f9cc19cd503","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:dc60d5209c1863550637515a8147c0c11a36894b1b9c06f4cc99dc503172a299","observation_id":"c8df579f-deee-47f6-8fbf-15771e9f4fbf","resolution":{"observed_at":"2026-07-10T20:57:36.150619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.737441Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"44940506-60da-47fb-a734-bf5bba9cd5fd","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:190dcd4846058d194423e4529bfc2f88f3dbc1a57a7cb22bbb6f6ccf0a61ca20","observation_id":"cc6ffbf2-7af3-42c4-8f0e-8647a82fb78a","resolution":{"observed_at":"2026-07-10T20:57:35.755585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.104437Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"db61c55f-a12c-44fe-a54a-675cd2c2cfdc","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:0b8e35940697e20ee26fe8aad30cc2980c92af06c1cdbd01b11d9f82a72b1db9","observation_id":"6816b258-4640-4cef-a02e-4e56f57bd002","resolution":{"observed_at":"2026-07-10T20:57:36.124849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.176740Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"3a3e6b9d-ac58-48ea-80f8-85fec77890e4","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ab7758f206c59847d65cb027748ccc0876ad263a03455d152e8e3658e634e290","observation_id":"124c36e0-98f4-4f90-a407-90f1939d1605","resolution":{"observed_at":"2026-07-10T20:57:36.194167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.129664Z","title":"2023 IEEE International Conference on Data Mining (ICDM) , year=","venue":null,"work_id":"e0d46201-8497-4600-8eaf-5652075f3ff6","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:70c4fd5cfd5dda7e27d14cafa93e38c7e6f08811c9ce61f0b71ac6ffdcab685a","observation_id":"4be6e1ec-8e57-49db-a1d2-c2cf32f1cb06","resolution":{"observed_at":"2026-07-10T20:57:36.161683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.058846Z","title":null,"venue":null,"work_id":"df8b6c8b-76b7-4c5e-9a56-7095787d5d1b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:1d1eba3187cc2d829da1028a121ed83cf49ba0b3c1406d25ff6aa955e786241d","observation_id":"b00b1bde-ad4b-4ea9-9df8-ea3af2c07c2d","resolution":{"observed_at":"2026-07-10T20:57:36.079001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.003391Z","title":", author=","venue":null,"work_id":"2b140c62-8d93-47cc-9ab5-3c89ef184f72","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:2f6f2aa901b216642a9a65fac48ac5fd8bef952b3cd7db5c2e5859e4b99bd221","observation_id":"cec6a989-10fc-49e7-b3a5-11983b085f6b","resolution":{"observed_at":"2026-07-10T20:57:36.023043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.023528Z","title":null,"venue":null,"work_id":"42d2d08b-e44a-4ec6-a2ab-cdce7c5245db","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6260e052e06d7d47a2d6d06eec7f5e62821458d18b8a3306aeab8184d8c31b6d","observation_id":"fc2df9e2-f8fc-4617-bc11-395765a58e6e","resolution":{"observed_at":"2026-07-10T20:57:36.051407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22606","last_updated":"2025-07-30T12:22:30Z","snapshot_observed_at":"2026-08-14T06:31:20.717304Z","submitted_at":"2025-07-30T12:22:30Z","title":"MetaAgent: Automatically Constructing Multi-Agent Systems Based on Finite State Machines","version":1},"cited_work":{"arxiv_id":"2507.22606","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.22606","snapshot_observed_at":"2026-07-10T20:57:34.446889Z","title":"arXiv preprint arXiv:2507.22606 , year=","venue":"cs.AI","work_id":"1603f206-ccdf-4328-b817-dd2ee8466ae9","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2507.22606","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:22887544393f8fe90ce45d5cf0968267909ca15394ccab286a6bd8efd4f1f3a3","observation_id":"d95dc51a-1ab4-412d-a391-418669950e9d","resolution":{"observed_at":"2026-07-10T20:57:34.461963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04180","last_updated":"2025-06-09T05:15:47Z","snapshot_observed_at":"2026-08-12T17:28:17.974840Z","submitted_at":"2025-02-06T16:12:06Z","title":"Multi-agent Architecture Search via Agentic Supernet","version":2},"cited_work":{"arxiv_id":"2502.04180","doi":"10.48550/arxiv.2502.04180","metadata_source":"pith","pith_arxiv_id":"2502.04180","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zhang, L","venue":"cs.LG","work_id":"749a42f9-4e3e-42a9-b050-d9e44b9719e8","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2502.04180","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c8d0712c01b25aedd5225b57fca4c609521936edef0f9388e8155cb5076bdafa","observation_id":"5b2a31db-111b-4d64-a1c8-198d2506288c","resolution":{"observed_at":"2026-07-10T20:57:34.694548Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.370655+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.370655+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10762","last_updated":"2025-04-15T02:44:55Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:40:40Z","title":"AFlow: Automating Agentic Workflow Generation","version":4},"cited_work":{"arxiv_id":"2410.10762","doi":"10.48550/arxiv.2410.10762","metadata_source":"pith","pith_arxiv_id":"2410.10762","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AFlow: Automating Agentic Workflow Generation","venue":"cs.AI","work_id":"7418aa37-1972-4dd5-8da6-c588dfce4c5b","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2410.10762","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:9de9c33cba0a432e00fad4806d1a5aa4bc5f128b3e6f3abdb37e58ee46d8d626","observation_id":"8fcc7553-0acd-40c6-9583-6dfc4affe828","resolution":{"observed_at":"2026-07-10T20:57:34.906236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.107327+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.107327+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.815175Z","title":"ICPR , pages=","venue":null,"work_id":"df06cf84-9c8d-4516-98f3-9f2bd0be835b","year":2016},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:535a09dc8689c7af87b070c4d5be48abed359da3e4b97ed32218b19740c20451","observation_id":"940d5ae8-7013-4b98-997c-f90de31fc713","resolution":{"observed_at":"2026-07-10T20:57:35.834384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.668833Z","title":"Sensors , volume=","venue":null,"work_id":"814a4454-558e-476a-9555-b232e19e6525","year":2019},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:b04b1c3e37d2211e18e921a8b4bd84a7b4503161b2c2fe4dbae99dbc5012ec89","observation_id":"f0735b64-a0ab-4127-97fc-cb3e41555077","resolution":{"observed_at":"2026-07-10T20:57:35.682714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:54.372474Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":"da360c40-6481-4088-bd96-8e73e0280a6b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:9153813cf7b607e1a50f942d52ed079da50a3ca3611e8b12b4654f6a7fbd4486","observation_id":"dcc6986a-47b0-47d3-b7e4-f8f63fae48b9","resolution":{"observed_at":"2026-07-10T20:57:36.126079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03125","last_updated":"2025-08-05T06:14:53Z","snapshot_observed_at":"2026-08-06T08:33:34.142274Z","submitted_at":"2025-08-05T06:14:53Z","title":"Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MAS","version":1},"cited_work":{"arxiv_id":"2508.03125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.03125","snapshot_observed_at":"2026-07-10T20:57:34.795349Z","title":"Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MAS","venue":"cs.CR","work_id":"7261bcb2-6754-4be6-8e9c-f084e7d1fade","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2508.03125","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:44b32156b31659101f5c3ba1e7ecf3b1a7c202a6c99266929608cfb86d13b8b1","observation_id":"5b6114b8-3d60-4d89-9034-5b3a49d97c3f","resolution":{"observed_at":"2026-07-10T20:57:34.810598Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-13T05:08:43.201033Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":35,"parse_uncertain":0,"unresolved":5,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 0 inbound Pith citation observations for arXiv:2607.06807."}