{"as_of":"2026-08-20T10:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db8796a5a429878a4a3e1b58a733de7d895389131d00471c62714cbfa2521f74","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:26:36.964619Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11888/citation-record","integrity":"/paper/2608.11888/integrity","json":"/paper/2608.11888/citation-record.json","paper":"/paper/2608.11888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.12670","last_updated":"2026-03-13T07:33:01Z","snapshot_observed_at":"2026-08-12T09:12:28.700231Z","submitted_at":"2026-02-13T07:06:06Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12670","snapshot_observed_at":"2026-08-16T00:26:36.830531Z","title":"Skillsbench: Benchmarking how well agent skills work across diverse tasks,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.830531Z"},"links":{"cited_paper":"/paper/2602.12670","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:ed2308ee6db06f3585c3c02a6c466a1e6f3f40930f4cb5795433acd9c5c72336","observation_id":"880a41a7-b057-477a-a641-ac2b56d97433","resolution":{"observed_at":"2026-08-16T00:26:36.830531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.835083Z","title":"Swe-skills- bench: Do agent skills actually help in real-world software engineering?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.835083Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:79784ba56c40962c214eff0760389e5796cbcb2b1c5a1e87a830cb99caf4b75a","observation_id":"3ccb5c91-4931-405b-acf9-b5167a0c7fba","resolution":{"observed_at":"2026-08-16T00:26:36.835083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.497118Z","title":"Lost in the middle: How language models use long contexts,","venue":null,"work_id":"5da2534b-0110-4498-8ddf-74cebc694748","year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.839062Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:28fc6277cd734f241c98c6fdbbd9bccae0c7b3ee1d9c12cfcd2ec340a210cd0a","observation_id":"9d304092-63ab-4396-911d-6e9fbd363b04","resolution":{"observed_at":"2026-08-16T00:26:37.501567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.843224Z","title":"Large language models can be easily distracted by irrelevant context,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.843224Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:493d7add50848d904f721a9c81da7b02cc727eb69a5b71cd191f042a6d860615","observation_id":"6b2d0fdb-26a6-4c9d-aaa6-7252deb63e06","resolution":{"observed_at":"2026-08-16T00:26:36.843224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.476125Z","title":"Quantifying language models’ sensitivity to spurious features in prompt design or: How i learned to start worrying about prompt formatting,","venue":null,"work_id":"2c03fc00-9515-460c-9da3-c45b3c3b6bdd","year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.846965Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:8d93948d6f954007aeb65c4cb99396d57e63a28506d6f190a5953cf2a16da65c","observation_id":"bc9253a3-202f-41f4-8214-72a7ac68772c","resolution":{"observed_at":"2026-08-16T00:26:37.480516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.850899Z","title":"More doc- uments, same length: Isolating the challenge of multiple documents in rag,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.850899Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:f63605797e2f82296898e9520d6eaed5867a06e527e217c8cfd54730fb737410","observation_id":"39a5e884-301e-48c9-896c-acd4d461b098","resolution":{"observed_at":"2026-08-16T00:26:36.850899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.457087Z","title":"Differential testing for software,","venue":null,"work_id":"1f4fe006-e53f-4b67-a874-b76dccddb35c","year":1998},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.855273Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:f9a3ebe7db7cef82c0ef5f1b98adb4c50fb482dc76309ae40472433133db1cd4","observation_id":"5fe4a77f-ffcf-4967-b0da-39d15fdacaaf","resolution":{"observed_at":"2026-08-16T00:26:37.461786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.444329Z","title":"Equipping agents for the real world with agent skills,","venue":null,"work_id":"733c3319-b3a6-4613-b02c-297f181efdab","year":2025},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.860550Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:7c5b093323d2f12216a09afb04325b65ab4aa7c505836611aa1b81d520272b9e","observation_id":"899f2ebc-47de-4604-a7d0-98e4f6010311","resolution":{"observed_at":"2026-08-16T00:26:37.448393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.434163Z","title":"OpenCode: The open source coding agent,","venue":null,"work_id":"36081b44-e34a-4030-bcf1-262ec860a9bc","year":2025},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.864025Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:2569aec57d32e2506e2c11c1b9adbb126306b79ea0c9d3f22d2f60768dd3f8b3","observation_id":"35bca5fa-fd82-448d-892c-47827473563d","resolution":{"observed_at":"2026-08-16T00:26:37.437465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.423365Z","title":"Introducing claude opus 4.6,","venue":null,"work_id":"6b7a5207-b53d-4647-a21d-c6a59bc3a2d5","year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.868027Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:235f0e8a5d8a16e0414f9a93a03aa06e488b5c415f7db45f94b7ad06b69a5920","observation_id":"6346949e-831b-4403-a265-b1612ef26aae","resolution":{"observed_at":"2026-08-16T00:26:37.426617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.412174Z","title":"Introducing gpt-5.5,","venue":null,"work_id":"fc6b81d2-e543-4940-ba08-10d7ec582b59","year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.871784Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:4283c9ac5e9540fc0f5c0a62c3fc5580bd66c006e5bad7d49b50f2d7893cf3f3","observation_id":"ef7072a1-38dc-4a28-a1c0-7d7d76fe5171","resolution":{"observed_at":"2026-08-16T00:26:37.416047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.400928Z","title":"Ensemble methods in machine learning,","venue":null,"work_id":"e3822bc9-2890-4e03-b9c9-60c25d4a5a4f","year":2000},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.875499Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:f62a168b8312c4f6d89604d94dd6a3c580b9bbdeac5b63f3b0380c89f38b9baf","observation_id":"c8db957b-9181-465c-8170-6f4d4bba60b7","resolution":{"observed_at":"2026-08-16T00:26:37.405126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-16T00:26:36.879915Z","title":"Self-consistency improves chain of thought reasoning in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.879915Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:b3f3903b3cb5e8d5f28abe340717f815099e04368dd6d0db34943bd46e957417","observation_id":"804f795f-296f-4e4b-a27e-dba9b01f30f7","resolution":{"observed_at":"2026-08-16T00:26:36.879915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-16T00:26:36.884222Z","title":"V oyager: An open-ended embodied agent with large lan- guage models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.884222Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:d68ca233e77af1a9ba50450bd650bd8f848f9f16af720abb347a642674085d8e","observation_id":"c92d4d58-f465-432e-9e65-a6430f05a91f","resolution":{"observed_at":"2026-08-16T00:26:36.884222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.888921Z","title":"Executable code actions elicit better llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.888921Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:fbe843efdda56af8fc5aa06134383cd98a5adfb76cab4592e51fb065d534e72b","observation_id":"b92d28f2-2adb-47fb-8579-e06b17052d83","resolution":{"observed_at":"2026-08-16T00:26:36.888921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.383071Z","title":"Gpt4tools: Teaching large language model to use tools via self-instruction,","venue":null,"work_id":"60687449-a780-430b-b33d-d95a74802c92","year":2023},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.893131Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:e8f0b1224e77b72a516aa14907c73c6dba21d629afb7bb062986bd785b7e1480","observation_id":"8fbc1d13-ac23-42e8-8b33-a4929bb13464","resolution":{"observed_at":"2026-08-16T00:26:37.386875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-16T00:26:36.896497Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.896497Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:a5ea4d2b98749f99a0e5e6d1b0e638c613b277dc51f306f88c18e5b80cffc742","observation_id":"92d17c18-a0c1-4eec-aa6a-5f2a880bc79b","resolution":{"observed_at":"2026-08-16T00:26:36.896497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.370648Z","title":"Same task, more tokens: the impact of input length on the reasoning performance of large language models,","venue":null,"work_id":"b289ccca-0279-4e00-bad5-08dda23f338d","year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.900495Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:81b902f60f79265e8edad213bc87701d2667a7718b9d7669f2ed6270ab968314","observation_id":"e1310748-b14b-4210-ac1d-08f76de121ce","resolution":{"observed_at":"2026-08-16T00:26:37.374726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.904068Z","title":"Why do multi-agent llm systems fail?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.904068Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:240fee2e2cee9f72f88ef9be0a0b032c8b2f3f4a4d6dffaeb7c3f0008a76ff7c","observation_id":"03e8beaa-7204-4700-96e7-570a8d7f02f3","resolution":{"observed_at":"2026-08-16T00:26:36.904068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-08-17T17:32:59.508600Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01489","snapshot_observed_at":"2026-08-16T00:26:36.907676Z","title":"Agentless: Demystifying llm- based software engineering agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.907676Z"},"links":{"cited_paper":"/paper/2407.01489","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:5f41e142d07ee2ca6e7ad78cbbbbdc7bac4696dd57084c993ac9e3b4339a6a94","observation_id":"cf1d2fc8-ca0a-41b7-b68d-53691326170b","resolution":{"observed_at":"2026-08-16T00:26:36.907676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.352066Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering,","venue":null,"work_id":"febaf33e-2d6e-4e6b-8cd0-e6da60331bff","year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.912470Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:6a1ac82e77abc128d0ac129190ca0dda81952974565ec537dae5facad8b43ec0","observation_id":"6463b77a-1cf8-4f4a-b391-c5dfc1859dd0","resolution":{"observed_at":"2026-08-16T00:26:37.356205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.340455Z","title":"Swe-bench: Can language models resolve real-world github issues?","venue":null,"work_id":"40e81e11-306d-48e9-aa69-cb65ae67a585","year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.915976Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:ffb877f4b584d3ced7619ba9125c24c5e62694cfe964f7685735fc1915ed86f7","observation_id":"5bc29c56-70f1-48ab-84e1-f501c9cfda0b","resolution":{"observed_at":"2026-08-16T00:26:37.344590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-18T20:14:04.086811Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-16T00:26:36.919199Z","title":"Openhands: An open platform for ai software developers as generalist agents, 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.919199Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:5311d225ecee90492638b4594bc46985c8df62c6c5850e16ed63e696ba3cd9e7","observation_id":"ab050f45-5cea-44e7-af9b-674eae1fa51f","resolution":{"observed_at":"2026-08-16T00:26:36.919199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.327476Z","title":"Multi-swe-bench: A multilingual benchmark for issue resolving,","venue":null,"work_id":"ec949ab8-3ad5-4a2a-8670-da8f8c7a0b37","year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.922786Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:88b6260a2cb44f69496ac0321a052d86ed1793627ac73433cef8397cdf86a243","observation_id":"6e805c5d-84d0-4549-bce8-35fbe75cbd37","resolution":{"observed_at":"2026-08-16T00:26:37.332498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12115","last_updated":"2025-05-29T23:07:34Z","snapshot_observed_at":"2026-08-18T15:49:49.317002Z","submitted_at":"2025-02-17T18:41:16Z","title":"SWE-Lancer: Can Frontier LLMs Earn $1 Million from Real-World Freelance Software Engineering?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12115","snapshot_observed_at":"2026-08-16T00:26:36.926696Z","title":"Swe-lancer: Can frontier llms earn $1 million from real-world freelance software engineering?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.926696Z"},"links":{"cited_paper":"/paper/2502.12115","citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:b9511709773b617a6e9160f248d2f56b179e10d299b851f33c594da59b927a09","observation_id":"9166c087-402a-4c56-99f9-2ea25e418323","resolution":{"observed_at":"2026-08-16T00:26:36.926696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.312972Z","title":"Measuring ai ability to complete long software tasks,","venue":null,"work_id":"aadeada9-386b-4ba6-994b-ae166ca2e223","year":2026},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.930303Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:4288517d6390d893923404a9fc09a6342907754127d75b906b77d311cfe05fc5","observation_id":"9cb7da78-2257-48de-a27f-b6a68ab0ca69","resolution":{"observed_at":"2026-08-16T00:26:37.317630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.302074Z","title":"Understanding and detecting real-world performance bugs,","venue":null,"work_id":"4342143b-36b2-44c9-8211-b7f8b0a38a65","year":2012},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.934380Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:7f6391963e5142d26e63fd2b96104ced6673ce972f4e38758524cd43a88b0d31","observation_id":"b96ea37b-c03d-469c-8da3-06c81b357a64","resolution":{"observed_at":"2026-08-16T00:26:37.305473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.290773Z","title":"Discovering, reporting, and fixing perfor- mance bugs,","venue":null,"work_id":"8fb9e298-28c4-4933-aa5b-e5ef110ca77a","year":2013},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.937450Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:ad75ad8f52795e04cac29eb69e6f4738587f0ce303c66b16d7f298a1d8e8b1e3","observation_id":"aab1f957-4ef4-497c-aa30-a1be108ea07f","resolution":{"observed_at":"2026-08-16T00:26:37.294977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.278374Z","title":"Performance issues and optimizations in javascript: an empirical study,","venue":null,"work_id":"eded741a-53ea-4dea-bd7f-0c8cd44c82b1","year":2016},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.941136Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:3a6d80bf1d7f27b4e7a55bee3def8a4152693d2a19ec81834ccdce2094da91fa","observation_id":"37fceef0-e62d-4b25-8ad1-cf135d4532d1","resolution":{"observed_at":"2026-08-16T00:26:37.282486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.266271Z","title":"Understanding performance problems in deep learning systems,","venue":null,"work_id":"fd08ea73-77ca-47f1-9ffe-70b86408a5b8","year":2022},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.944870Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:e4a6c0cecb4f01da714b190c48410f79e689ee420616b698c71b8fb6fdab9159","observation_id":"d7045bb6-25f1-4f10-965b-4f946cdc590a","resolution":{"observed_at":"2026-08-16T00:26:37.270364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.245658Z","title":"A comprehensive study on deep learning bug characteristics,","venue":null,"work_id":"7d40dd60-544d-4ef6-8199-3131b7ee2d6e","year":2019},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.948225Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:7deae3432acddee0924820435b73ec1da33c966710de18c4fdbf2dcde44f8da2","observation_id":"f2735e11-491d-42db-905b-cb677e01f4dd","resolution":{"observed_at":"2026-08-16T00:26:37.253130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.951615Z","title":"Taxonomy of real faults in deep learning systems,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.951615Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:6c2cd2f91703c3395c1fb7cd8b1b79738302c36fb6fa8115c20654383f2eb0d2","observation_id":"0c106420-0050-4149-ac60-09e30d9750cf","resolution":{"observed_at":"2026-08-16T00:26:36.951615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:36.955099Z","title":"An empirical study on tensorflow program bugs,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.955099Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:fdc4b9549e4b50d585f9895a216c13e62c8b9595d060da4ddd6b817eeb276577","observation_id":"cad5573d-0fcc-4644-bad8-cec289311a6a","resolution":{"observed_at":"2026-08-16T00:26:36.955099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.220476Z","title":"An empirical study on configuration errors in commercial and open source systems,","venue":null,"work_id":"e1470eb1-56e6-4873-9a01-97c7ec04e205","year":2011},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.958385Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:5049757ed382e2acebffb183b6740cda3c22247c761a412f511b53775687147d","observation_id":"b6132151-456e-4736-b5b3-6abaced6b2b2","resolution":{"observed_at":"2026-08-16T00:26:37.224208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.208531Z","title":"Hey, you have given me too many knobs!: Understanding and dealing with over-designed configuration in system software,","venue":null,"work_id":"d633cb22-60a6-46d5-b742-a5db9af0cb0e","year":2015},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.961533Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:ef32093217f8b04352257e4e692ae74aed969e0ebc0adcb1eda90e66288f9620","observation_id":"8eb61ccd-7549-48f4-bcc6-eb991ce5e6df","resolution":{"observed_at":"2026-08-16T00:26:37.212836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:26:37.194648Z","title":"An empirical study on performance bugs for highly config- urable software systems,","venue":null,"work_id":"b02867f2-472f-400e-be43-93c8da43161f","year":2016},"citing_paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:26:36.964619Z"},"links":{"citing_paper":"/paper/2608.11888"},"observation_digest":"sha256:9502b78f5bc7e7fd262dbc17d5fc754b4ab825a315e2deb456de4eb5f31e05af","observation_id":"3cb0f87a-665b-4040-a1ae-60f9b1a61530","resolution":{"observed_at":"2026-08-16T00:26:37.200380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.11888","last_updated":"2026-08-12T10:15:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-20T01:35:49.739902Z","submitted_at":"2026-08-12T10:15:19Z","title":"Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2608.11888."}