{"as_of":"2026-08-14T20:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e68c9ea00087528957e2e4022fb8fba9e4ebbbc22bea719ab4a2d32d87ab595","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:57:07.014317Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T00:26:54.019256Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"cited_work":{"arxiv_id":"2507.17257","doi":"10.48550/arxiv.2507.17257","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"76b7d015-09aa-4e60-a5de-216763dce98f","year":2025},"citing_paper":{"arxiv_id":"2605.30169","last_updated":"2026-07-02T23:58:01Z","snapshot_observed_at":"2026-08-01T18:48:30.510137Z","submitted_at":"2026-05-28T16:20:19Z","title":"Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-06-29T00:26:54.019256Z"},"links":{"cited_paper":"/paper/2507.17257","citing_paper":"/paper/2605.30169"},"observation_digest":"sha256:fda3c2b4051cd4231e5c15444d57bb04c89a4e12edfde1bff60be539d24afb7e","observation_id":"e75ce735-be26-4773-b040-641474872e2b","resolution":{"observed_at":"2026-06-29T00:32:53.095668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17257/citation-record","integrity":"/paper/2507.17257/integrity","json":"/paper/2507.17257/citation-record.json","paper":"/paper/2507.17257"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.01502","last_updated":"2024-07-01T17:48:14Z","snapshot_observed_at":"2026-08-12T23:31:03.691496Z","submitted_at":"2024-07-01T17:48:14Z","title":"AI Agents That Matter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01502","snapshot_observed_at":"2026-08-06T14:57:06.463141Z","title":"Siegel, Nitya Nadgir, and Arvind Narayanan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.463141Z"},"links":{"cited_paper":"/paper/2407.01502","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:db0eb65ac0526b87caba05d62086b16261069880d5c385495c89d6548e339667","observation_id":"90bd6375-8c91-4597-a574-77070359b937","resolution":{"observed_at":"2026-08-06T14:57:06.463141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.475113Z","title":"Introducing Devin, the first AI software engineer, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.475113Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1393c89f9228c6b719219f1b230b704e6924a937586fb87d2dba0ec073ba3f16","observation_id":"945f1a7b-6fd7-4e19-ac75-042c8c279e6e","resolution":{"observed_at":"2026-08-06T14:57:06.475113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.480272Z","title":"GAIA: a benchmark for General AI Assistants, November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.480272Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:40a962a80296e3197b461135cc89b1d7be38f6a290316b4941ca3e8aeb634c52","observation_id":"69472970-6998-4831-9543-b426b146d6de","resolution":{"observed_at":"2026-08-06T14:57:06.480272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04682","last_updated":"2025-04-16T22:20:21Z","snapshot_observed_at":"2026-08-14T13:13:41.524170Z","submitted_at":"2024-08-08T05:45:42Z","title":"ToolSandbox: A Stateful, Conversational, Interactive Evaluation Benchmark for LLM Tool Use Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04682","snapshot_observed_at":"2026-08-06T14:57:06.486170Z","title":"ToolSandbox: A Stateful, Conversational, Interactive Evaluation Benchmark for LLM Tool Use Capabilities, August 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.486170Z"},"links":{"cited_paper":"/paper/2408.04682","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:7bab571031de7ce99d132469ffe410a448e936ce92c63ed11400e359f8bbfbb7","observation_id":"8985ac9c-af6b-44df-94c6-5f026bf80eae","resolution":{"observed_at":"2026-08-06T14:57:06.486170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-08-12T23:03:01.500686Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-08-06T14:57:06.491612Z","title":"Zhang, Neil Perry, Riya Dulepet, Eliot Jones, Justin W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.491612Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5b288b4d6ac6e30e4ef968b9094064e2e99571e8af3b1dbfed9363903e0abdb1","observation_id":"a2e33d96-9c84-4793-a4d4-08cedb088a61","resolution":{"observed_at":"2026-08-06T14:57:06.491612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-06T14:57:06.497559Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.497559Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5617aa1fefbd5c9fbfe56c584cf1b5ea49e7e75a8f7919e699f5a32189a646a2","observation_id":"32ab33e2-503c-4e5c-8737-589af7213ef5","resolution":{"observed_at":"2026-08-06T14:57:06.497559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.502779Z","title":"Jimenez, John Yang, Kevin Liu, and Aleksander Madry","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.502779Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3201c0772550f60884b555e8176f754673509041f783fdbaa206bcbcd6af2786","observation_id":"c5116462-c38d-4f22-9bee-eaecab64161e","resolution":{"observed_at":"2026-08-06T14:57:06.502779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12856","last_updated":"2024-02-25T16:17:43Z","snapshot_observed_at":"2026-08-14T05:33:25.547274Z","submitted_at":"2023-07-24T14:56:30Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12856","snapshot_observed_at":"2026-08-06T14:57:06.508586Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis, February 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.508586Z"},"links":{"cited_paper":"/paper/2307.12856","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b363fca8940f3e580725a96c0c5108d6c96b93ff0c55c4dabc159d4719c63e5c","observation_id":"e10fb22f-ea94-4a24-88c8-0d62453d73a5","resolution":{"observed_at":"2026-08-06T14:57:06.508586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.513987Z","title":"MultiOn AI, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.513987Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:da3f7bb45c0cc2accdd1e845ebf2243cca408f461b440974bfd7442d8c82f047","observation_id":"7434111f-2dea-4750-9cbc-7bc751762b1c","resolution":{"observed_at":"2026-08-06T14:57:06.513987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.519681Z","title":"Agents that reduce work and information overload.Communications of the ACM, 37(7):30–40, July 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.519681Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2e99f92f304ad1127e3e2e1cd93942395d00e92ca4b120d587499a4ec6bd6daf","observation_id":"8b2999e5-6fd0-465a-8655-893edee84222","resolution":{"observed_at":"2026-08-06T14:57:06.519681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.525291Z","title":"Artificial life meets entertainment: lifelike autonomous agents.Communications of the ACM, 38(11):108–114, November 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.525291Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:7ad1dd118638d3820c1ddd5bac504ad6b9be4a03425d6870f84790feb100ed23","observation_id":"a7759664-acff-462f-b635-aac716f94f0a","resolution":{"observed_at":"2026-08-06T14:57:06.525291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.530778Z","title":"Autonomous interface agents","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.530778Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:a3744dfb278ed313b42a5ba3522e216ae895e15c42e9727067399ea5ee3a9f29","observation_id":"db8ed391-0c32-4d5a-82b0-45fed6ecde76","resolution":{"observed_at":"2026-08-06T14:57:06.530778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.535664Z","title":"A roadmap of agent research and development.Autonomous agents and multi-agent systems, 1:7–38, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.535664Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3ab96d163870a92a174390296e54ab0ad984368107085378bca0189c73872bee","observation_id":"a4f0d0d0-972e-4622-9d3f-d5e27980c9d1","resolution":{"observed_at":"2026-08-06T14:57:06.535664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.541028Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.541028Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:431cb07ecbe465b32a18ce6c48396acd39da984cb7bdc5bd1d29c26bbc6d5b20","observation_id":"d0e3df6e-dbf9-44d7-98e4-270a481e4533","resolution":{"observed_at":"2026-08-06T14:57:06.541028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.546230Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.546230Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:6ea4633b7c07af07fcaccad9839b7163e83fe6672be4e39de385d3b3f2437424","observation_id":"83473c7d-0f6a-4595-a04b-0cbccf4774c7","resolution":{"observed_at":"2026-08-06T14:57:06.546230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.551410Z","title":"Russell and Peter Norvig.Artificial Intelligence: A Modern Approach","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.551410Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:462e192fe6be04c326e48e9da11d1fd73d36be5967773d34a74df442cf14ac3d","observation_id":"672f404c-3772-4a1a-abcd-3d86ff36d32b","resolution":{"observed_at":"2026-08-06T14:57:06.551410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.556692Z","title":"Harms from Increasingly Agentic Algorithmic Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.556692Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:261fb261089ef7c752f129ffccd390a6a86997fcb059f4dd8d544591dac3f094","observation_id":"de2bfb9b-e387-4eff-8d0c-2dc7856635f9","resolution":{"observed_at":"2026-08-06T14:57:06.556692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-06T14:57:06.562823Z","title":"White, Doug Burger, and Chi Wang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.562823Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:86c6334eb8c2a8755ee5884d8cc2b22a8929a234c10b4a2f609d1c350b954e7b","observation_id":"746aebd6-f3a8-416f-a363-6e72ba19984a","resolution":{"observed_at":"2026-08-06T14:57:06.562823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.569557Z","title":"OpenAI Charter, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.569557Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:98b5ab2a57fd08f23c2b979d392e928dbe1241ea40107b97d18ca6787898f5f0","observation_id":"2c1ea291-854c-4179-95d8-01de49566168","resolution":{"observed_at":"2026-08-06T14:57:06.569557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16244","last_updated":"2024-04-28T18:28:33Z","snapshot_observed_at":"2026-08-13T00:22:42.339818Z","submitted_at":"2024-04-24T23:18:46Z","title":"The Ethics of Advanced AI Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16244","snapshot_observed_at":"2026-08-06T14:57:06.575199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.575199Z"},"links":{"cited_paper":"/paper/2404.16244","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3c13e7d751ca5fb11de6dcd789ae6343d696f4b3076d78c6972e4168fd7db6ff","observation_id":"1326a40c-96ed-4430-8f13-415b0a409744","resolution":{"observed_at":"2026-08-06T14:57:06.575199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.581377Z","title":"Governing AI Agents, April 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.581377Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:34318b353fa4b216ee3a5dcc7b2ca23cd842e15acae645b9e99e4b59bd383c06","observation_id":"d75cdf1d-b80b-47e8-b82b-df8b4258541e","resolution":{"observed_at":"2026-08-06T14:57:06.581377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.588723Z","title":"Potter and Kevin J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.588723Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:8ecae328d8208a1a76e894cf6cc82e86087ccea38523dc70f7f59c9b70e453c1","observation_id":"0a6431b4-4476-4047-b056-7635743f9d17","resolution":{"observed_at":"2026-08-06T14:57:06.588723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.593854Z","title":"Position: Stop acting like language model agents are normal agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.593854Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:97cfaf06031a78d3fc538b01b20a7324a3c177bbbaedc0e726595ff3935ad9d4","observation_id":"17a9dce9-82a0-4fdc-ae1a-ae463859cd48","resolution":{"observed_at":"2026-08-06T14:57:06.593854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.599169Z","title":"Emergent causality and the foundation of consciousness","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.599169Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c358fc7fa0b6fffe7086b9c56e14d26149275b695cac9a964506f24af141c65e","observation_id":"d3dc9ae4-b0f9-40aa-8832-27e2b4d228dc","resolution":{"observed_at":"2026-08-06T14:57:06.599169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.604343Z","title":"Compression, the fermi paradox and artificial super-intelligence","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.604343Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4e06b2bd1d6812aaf6ede230060fc8dadd986d4ada83252b982c4b74ccc6c9a0","observation_id":"ec33ae29-47cb-4f7f-9595-e578ed8ad0d4","resolution":{"observed_at":"2026-08-06T14:57:06.604343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.609869Z","title":"World Scientific, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.609869Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:9e22bc145831f81c0b2b9afd8b89dcf6edc34390b854540c8765b39e54f18750","observation_id":"7889ef22-788c-4144-8b6f-8664c3391ed8","resolution":{"observed_at":"2026-08-06T14:57:06.609869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.620551Z","title":"Thorisson.A New Constructivist AI: From Manual Methods to Self-Constructive Systems, pages 145–171","venue":null,"work_id":"ab643dff-4ed6-4f16-abea-df50fb05f764","year":2012},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.614775Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:676d78b1112b6396a14e470b98e07707f8a0b6d068115facf61107aff685b3c8","observation_id":"cf7a54d8-162a-401d-bd87-f4d51fce04f4","resolution":{"observed_at":"2026-08-06T14:57:08.627558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.600730Z","title":"Artificial general intelligence: Concept, state of the art.Journal of Artificial General Intelligence, 5(1):1–48, 2014","venue":null,"work_id":"4ec0208a-f982-4ee2-b4b8-a1339690a60e","year":2014},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.620260Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:db1c9eeac5ac79910469f1d290bd204d6839dbcfd35b5fbee08c4b2836594039","observation_id":"bc84d72b-86d4-4056-87a0-310a48c5281c","resolution":{"observed_at":"2026-08-06T14:57:08.607831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-13T14:09:17.964744Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-06T14:57:06.625605Z","title":"Agentbench: Evaluating llms as agents.arXiv preprint arXiv:2308.03688, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.625605Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:d8afa7f6ed0c05f40d0ddc9e115c859bc426b9cff2bfbb92e219426e00bcf268","observation_id":"e2bcb39f-eb72-46e0-be5f-d87dec9d79ce","resolution":{"observed_at":"2026-08-06T14:57:06.625605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-08-13T10:06:26.439949Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-06T14:57:06.633930Z","title":"Gaia: a benchmark for general ai assistants.arXiv preprint arXiv:2311.12983, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.633930Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:41ea3495f77bae7394d9e3184bbc2d72ad0a2f317c10dca8806ae477f592a4b0","observation_id":"52b961ae-a22f-47fa-96da-851c8e5427a0","resolution":{"observed_at":"2026-08-06T14:57:06.633930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03302","last_updated":"2024-04-14T21:02:16Z","snapshot_observed_at":"2026-08-13T05:57:05.956099Z","submitted_at":"2023-10-05T04:06:12Z","title":"MLAgentBench: Evaluating Language Agents on Machine Learning Experimentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03302","snapshot_observed_at":"2026-08-06T14:57:06.640490Z","title":"Mlagentbench: Evaluating language agents on machine learning experimentation.arXiv preprint arXiv:2310.03302, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.640490Z"},"links":{"cited_paper":"/paper/2310.03302","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:de738b0495e98a32a5392e651d3ecdd1d36f30d7ab3bc28bb914a8af3b601d5d","observation_id":"43152c97-83f1-4231-afce-e6da05582938","resolution":{"observed_at":"2026-08-06T14:57:06.640490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04026","last_updated":"2023-08-08T03:59:28Z","snapshot_observed_at":"2026-08-13T18:07:56.522435Z","submitted_at":"2023-08-08T03:59:28Z","title":"AgentSims: An Open-Source Sandbox for Large Language Model Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04026","snapshot_observed_at":"2026-08-06T14:57:06.646251Z","title":"Agentsims: An open-source sandbox for large language model evaluation.arXiv preprint arXiv:2308.04026, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.646251Z"},"links":{"cited_paper":"/paper/2308.04026","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:e242c491cd18cc951b11f3278d39f403ba473e06642cd0db35ea3b838dfe4351","observation_id":"33891f3f-acec-4c08-bd5c-dcd9349a5315","resolution":{"observed_at":"2026-08-06T14:57:06.646251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01275","last_updated":"2024-01-09T18:54:05Z","snapshot_observed_at":"2026-08-13T17:10:05.949133Z","submitted_at":"2024-01-02T16:20:40Z","title":"CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01275","snapshot_observed_at":"2026-08-06T14:57:06.652456Z","title":"Charactereval: A chinese benchmark for role-playing conversational agent evaluation.arXiv preprint arXiv:2401.01275, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.652456Z"},"links":{"cited_paper":"/paper/2401.01275","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:a187cbdfe379a44145f408cf446fbc36d0fa1b795426d593a39148f30c2d7b85","observation_id":"c549e7f8-995f-4bfa-ac27-180421bcdbd8","resolution":{"observed_at":"2026-08-06T14:57:06.652456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17332","last_updated":"2025-06-24T04:10:59Z","snapshot_observed_at":"2026-08-14T18:50:46.765784Z","submitted_at":"2025-03-21T17:32:32Z","title":"CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17332","snapshot_observed_at":"2026-08-06T14:57:06.658280Z","title":"Cve-bench: A benchmark for ai agents’ ability to exploit real-world web application vulnerabilities.arXiv preprint arXiv:2503.17332, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.658280Z"},"links":{"cited_paper":"/paper/2503.17332","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:6cad18e873d91f94ba2661101d65a0910297eca91540f9a824fc24c6a518f2e8","observation_id":"3ef074a3-eee1-4112-841a-28577879b915","resolution":{"observed_at":"2026-08-06T14:57:06.658280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-06T14:57:06.663765Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents.arXiv preprint arXiv:2503.01935, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.663765Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5ecb5500583516963270d37f53021bbcbb35516a30c1ce000690676f5b1c9ca5","observation_id":"d02d8bf0-e065-4fe5-8a9a-ad4782b7ba78","resolution":{"observed_at":"2026-08-06T14:57:06.663765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04808","last_updated":"2025-04-14T19:46:56Z","snapshot_observed_at":"2026-08-13T21:34:08.034098Z","submitted_at":"2025-04-07T08:03:36Z","title":"ELT-Bench: An End-to-End Benchmark for Evaluating AI Agents on ELT Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04808","snapshot_observed_at":"2026-08-06T14:57:06.669214Z","title":"Elt-bench: An end-to-end benchmark for evaluating ai agents on elt pipelines.arXiv preprint arXiv:2504.04808, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.669214Z"},"links":{"cited_paper":"/paper/2504.04808","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ecba416b384b083309b2a5d3c95d1cdbe87f9488a40c4ec17d372e2cc2cf12c9","observation_id":"804ceb17-0626-4071-be1b-d4827f4bb80f","resolution":{"observed_at":"2026-08-06T14:57:06.669214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07869","last_updated":"2025-02-23T15:16:14Z","snapshot_observed_at":"2026-08-12T22:26:22.746383Z","submitted_at":"2024-10-10T12:41:19Z","title":"Benchmarking Agentic Workflow Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07869","snapshot_observed_at":"2026-08-06T14:57:06.674390Z","title":"Benchmarking agentic workflow generation.arXiv preprint arXiv:2410.07869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.674390Z"},"links":{"cited_paper":"/paper/2410.07869","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2e554f8fa68816099c65ae4e1e82e0d627ff27468f0bc6c71444d35931a94380","observation_id":"a9ee71b9-a33c-4ed2-bda6-c1bd3e44cf3c","resolution":{"observed_at":"2026-08-06T14:57:06.674390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00081","last_updated":"2024-10-31T17:53:12Z","snapshot_observed_at":"2026-08-12T22:10:19.884376Z","submitted_at":"2024-10-31T17:53:12Z","title":"PARTNR: A Benchmark for Planning and Reasoning in Embodied Multi-agent Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00081","snapshot_observed_at":"2026-08-06T14:57:06.679450Z","title":"Turner, Eric Undersander, and Tsung-Yen Yang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.679450Z"},"links":{"cited_paper":"/paper/2411.00081","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0d5ad3f0561f32c377aac932508ee29067b6589fdc95fa05ed51b481d3f14d82","observation_id":"f9a3f08d-56b6-4d43-b786-a86940cb4b05","resolution":{"observed_at":"2026-08-06T14:57:06.679450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.684556Z","title":"John wiley & sons, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.684556Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:95d7729a78abaa7563f83d3e3f0df0b1b4bcfff5c2db8184308ae622a37aeb59","observation_id":"2b1e2002-fd6c-43b5-aad9-15252b844b2d","resolution":{"observed_at":"2026-08-06T14:57:06.684556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.568214Z","title":"Is it an agent, or just a program? a taxonomy for autonomous agents","venue":null,"work_id":"b040fed2-67c0-472d-b792-1a6de2f73b5c","year":1997},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.689804Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:002fb5239c2b3076425dd34e74c3c83cc59339bfe5ee8e97b15eeba3584621f6","observation_id":"cd8da897-fddb-42aa-acf7-3c7fd8515160","resolution":{"observed_at":"2026-08-06T14:57:08.573766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.694956Z","title":"Jennings","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.694956Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1a81a548995676ea6a54c460e523c72b593182bb0ef8e739fc835956f83c0c1c","observation_id":"04543301-01cb-4902-a72a-ad8da4b74a81","resolution":{"observed_at":"2026-08-06T14:57:06.694956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.532565Z","title":"Adversarial nli: A new benchmark for natural language understanding","venue":null,"work_id":"f587af69-616c-40f6-b08a-eba4563018b3","year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.700379Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:604dfa0397339854527ba12aacefe8e797ad4684ae58cd260454f0e36b67add1","observation_id":"a607cefc-00b4-419f-940b-2a2a753c0a26","resolution":{"observed_at":"2026-08-06T14:57:08.539061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.513882Z","title":"Metagpt: Meta programming for multi-agent collaborative framework","venue":null,"work_id":"05ac7e90-e21a-444a-bd71-3706b0e9dbd9","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.705353Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:da77c89e99f4d4cf54d1ba409072a85f03daaa798b76f800894f24ec5717a00f","observation_id":"95826660-379d-4eb6-9756-e95ab877cf27","resolution":{"observed_at":"2026-08-06T14:57:08.519669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T14:57:06.710356Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.710356Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b04e15380bb95c0804ba55912a778c1a23e6a7efc903f6ded37e7d1597114256","observation_id":"0d7e05da-9a35-4c94-9b5d-ee9effd20baf","resolution":{"observed_at":"2026-08-06T14:57:06.710356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.716016Z","title":"Langchain.https://github.com/langchain-ai/langchain, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.716016Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3b33cdf66910ce94b12f996e55ad34e457c443b622b09f018d9735b0b696283c","observation_id":"f23d8a28-6c94-450f-98d5-75788a28f913","resolution":{"observed_at":"2026-08-06T14:57:06.716016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.474952Z","title":"Thórisson","venue":null,"work_id":"592f0da0-4e83-4519-ad93-a1020e50bcd7","year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.721374Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b319e8f82159ab43a26fa1f53ff2587bd773e1d02e8c43fe5408258bf1df8b26","observation_id":"a4a7f49f-a8d2-47bd-bf03-dd47b7d09ada","resolution":{"observed_at":"2026-08-06T14:57:08.480959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.455844Z","title":"Autocatalytic endogenous reflective architecture","venue":null,"work_id":"2cdb7efe-ea59-4e44-a7d4-4fd4c6a5b13a","year":2013},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.726076Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c66bb6f199dddadd64c7d3c89ddc1e88ed657138c8168e1a1efcba10c3e7e21c","observation_id":"74d8fa55-dc95-48bc-bf98-dda8ff0f92f4","resolution":{"observed_at":"2026-08-06T14:57:08.461528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.435084Z","title":"Wang.Rigid Flexibility: The Logic of Intelligence","venue":null,"work_id":"180d817d-476a-413b-9264-364c1d54370c","year":2006},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.730962Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:03b20966afa70f1ff2e15b495ce6aa72b56c068f9158599b7ac4e7f65d5cac7d","observation_id":"a2c2b775-dd2f-49a8-afee-f14d11658249","resolution":{"observed_at":"2026-08-06T14:57:08.441732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.417605Z","title":"‘opennars for applications’: Architecture and control","venue":null,"work_id":"6a615305-de9b-4202-8429-db6407bf2283","year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.736311Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:67ebd12a5d73f6cff205d05e9d5d2879f70110c3b974f95e91864745e84f07ed","observation_id":"2bcc24a6-5df1-4d5c-a8be-4f9cece8686c","resolution":{"observed_at":"2026-08-06T14:57:08.422928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.398593Z","title":"The general theory of general intelligence: A pragmatic patternist perspective","venue":null,"work_id":"5c559967-f775-4f0c-bec9-ba9821e9d217","year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.742133Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:9625a69b82feac05901da5dbc3e04e97141b78c48e2d66d515691b7695b2c374","observation_id":"cdf351cb-faeb-43dc-81e8-c24744186362","resolution":{"observed_at":"2026-08-06T14:57:08.404633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.378355Z","title":"Opencog hyperon: A framework for agi at the human level and beyond","venue":null,"work_id":"cd7253f7-3ffd-4a78-803b-b2a82e423e57","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.747813Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4588868921dad39ef37fb3a650869467106ed4cad696e3b42756086a895db675","observation_id":"da8d3d15-f4dc-45e4-b0a8-05e76f77a4d3","resolution":{"observed_at":"2026-08-06T14:57:08.384987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02427","last_updated":"2024-03-15T15:44:11Z","snapshot_observed_at":"2026-08-13T14:45:55.055776Z","submitted_at":"2023-09-05T17:56:20Z","title":"Cognitive Architectures for Language Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02427","snapshot_observed_at":"2026-08-06T14:57:06.753218Z","title":"Sumers, Shunyu Yao, Karthik Narasimhan, and Thomas L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.753218Z"},"links":{"cited_paper":"/paper/2309.02427","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:443efd0240bc13e2ce04acf0f8e9f16d8f69f20b66b4313269f778e98eab402d","observation_id":"915ff8e5-45f6-4f21-bc6c-1d10ed3a60b4","resolution":{"observed_at":"2026-08-06T14:57:06.753218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.358277Z","title":"Language agents in the digital world: Opportunities and risks.princeton-nlp.github.io, Jul 2023","venue":null,"work_id":"c58c002c-1def-44a0-a823-3e4738d170f9","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.758612Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:90ef5391d4168c11c0253237747befaffa7e4f3d0ba9e04eefa1555a9949f3ee","observation_id":"92bad81b-a4ac-45d9-ac1b-510ddd997125","resolution":{"observed_at":"2026-08-06T14:57:08.363823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.339247Z","title":"Practices for governing agentic ai systems","venue":null,"work_id":"f2ac6e3f-cecf-4673-a1af-a38ddb560e9c","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.763988Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:80c119aaf81b30b34ce85107128c334c0c486e79091eb222b5e38f41ea630c41","observation_id":"5f24bec1-a7ad-4d23-b8df-a93f33229745","resolution":{"observed_at":"2026-08-06T14:57:08.345775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.319264Z","title":"Langlois, Pedro A","venue":null,"work_id":"0cc84f51-892c-4dea-9a81-8fcd32ede338","year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.769739Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:450b95d15101d78f495da36e8715a6dd3029483ce593e85864b37f2002e6333b","observation_id":"fbd1cec1-c232-4682-a0d0-5ce705925f94","resolution":{"observed_at":"2026-08-06T14:57:08.324834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13138","last_updated":"2024-05-17T17:45:05Z","snapshot_observed_at":"2026-08-13T04:35:55.258313Z","submitted_at":"2024-01-23T23:18:33Z","title":"Visibility into AI Agents","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13138","snapshot_observed_at":"2026-08-06T14:57:06.774550Z","title":"Visibility into AI agents.arXiv: 2401.13138 [cs.CY], January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.774550Z"},"links":{"cited_paper":"/paper/2401.13138","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:317dde954630d8b847063e560786ff676e845dcca4f30e3d865c56a3bf1ab5f7","observation_id":"b1c14acb-291a-4f21-870f-6d2b5435512e","resolution":{"observed_at":"2026-08-06T14:57:06.774550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.301327Z","title":"Attention is all you need","venue":null,"work_id":"c79ae75f-3c04-41d9-a0da-9abb76ccdfd5","year":2017},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.780280Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0fa01cbc44d8e575e07b41dbad68087800f688437f75d95a149980aab5fec267","observation_id":"6946e8d5-3a53-4839-abbb-c76404867d5e","resolution":{"observed_at":"2026-08-06T14:57:08.306755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14627","last_updated":"2022-07-29T11:53:22Z","snapshot_observed_at":"2026-08-13T14:54:23.725307Z","submitted_at":"2022-07-29T11:53:22Z","title":"\"Do you follow me?\": A Survey of Recent Approaches in Dialogue State Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.14627","snapshot_observed_at":"2026-08-06T14:57:06.785581Z","title":"do you follow me?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.785581Z"},"links":{"cited_paper":"/paper/2207.14627","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:28505a4a772e167b39f62612555ccab4b89d5812810528f85561a251dcc5e7ec","observation_id":"e7c8b012-c9bf-4d9a-88c3-6474a32cc3c2","resolution":{"observed_at":"2026-08-06T14:57:06.785581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.281194Z","title":"Multi-domain dialogue state tracking with disentangled domain-slot attention","venue":null,"work_id":"0fc08aec-67f4-4df2-b7f4-fcdb69b7f2f7","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.791317Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ddc4f253d866e8a4b8e7501496be6acfc53e7ab3f14eafe58a1d9ff6f9de7908","observation_id":"f3d31cfa-957b-495e-8293-0e4e54dccf72","resolution":{"observed_at":"2026-08-06T14:57:08.287517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14970","last_updated":"2023-10-23T14:15:28Z","snapshot_observed_at":"2026-08-13T05:43:05.125087Z","submitted_at":"2023-10-23T14:15:28Z","title":"Towards LLM-driven Dialogue State Tracking","version":1},"cited_work":{"arxiv_id":"2310.14970","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.14970","snapshot_observed_at":"2026-08-06T14:57:07.471336Z","title":"Towards LLM-driven Dialogue State Tracking","venue":"cs.CL","work_id":"42f9c17d-0673-4679-aada-b9ed64f33beb","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.796551Z"},"links":{"cited_paper":"/paper/2310.14970","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c1a3eb11696709ac9adcbdf704c551118aa908fdb3293cc6c603735cc32c92ad","observation_id":"ec5e05ec-665d-4be0-a55b-700914390034","resolution":{"observed_at":"2026-08-06T14:57:07.477381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.15055","last_updated":"2020-10-14T08:51:40Z","snapshot_observed_at":"2026-08-11T00:51:15.511781Z","submitted_at":"2020-06-26T15:31:57Z","title":"Object-Centric Learning with Slot Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.15055","snapshot_observed_at":"2026-08-06T14:57:06.801744Z","title":"Unsal, Sjoerd Behbahani, Dirk Weissenborn, Heiko Küttler, Daniel Zoran, Adrià Puigdomenech Badia, Bernhard Schölkopf, Raia Hadsell, and Olivier Bachem","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.801744Z"},"links":{"cited_paper":"/paper/2006.15055","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:871f2668204dfc937c0b330c004623ce437f589cabdba5b26bea14e2f5d6c64e","observation_id":"8a17dc82-efc5-4e51-8b2c-2887ac3113ff","resolution":{"observed_at":"2026-08-06T14:57:06.801744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10305","last_updated":"2024-05-16T17:56:55Z","snapshot_observed_at":"2026-08-13T00:05:36.136274Z","submitted_at":"2024-05-16T17:56:55Z","title":"4D Panoptic Scene Graph Generation","version":1},"cited_work":{"arxiv_id":"2405.10305","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.10305","snapshot_observed_at":"2026-08-06T14:57:07.429098Z","title":"4D Panoptic Scene Graph Generation","venue":"cs.CV","work_id":"301739ac-f615-4843-90f3-e70c049c9fe0","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.806851Z"},"links":{"cited_paper":"/paper/2405.10305","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:84d98b3245239b07990b61a0b49d193c0998c368e6c8abadf4782834060e97b0","observation_id":"db263df3-14bd-4d11-91be-81faad2405bc","resolution":{"observed_at":"2026-08-06T14:57:07.434467Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00443","last_updated":"2022-06-22T09:19:40Z","snapshot_observed_at":"2026-08-14T13:00:14.886000Z","submitted_at":"2022-01-03T00:55:33Z","title":"Scene Graph Generation: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2201.00443","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.00443","snapshot_observed_at":"2026-08-06T14:57:07.405029Z","title":"Scene Graph Generation: A Comprehensive Survey","venue":"cs.CV","work_id":"a5874869-2c2f-43db-a92a-7081ed229c43","year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.811983Z"},"links":{"cited_paper":"/paper/2201.00443","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ef0a3f65618975aeb5687063698de6f5869b6d2036c3345144caff43e14e059c","observation_id":"43676c60-28f5-4613-8984-92cb44f28a37","resolution":{"observed_at":"2026-08-06T14:57:07.410678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00906","last_updated":"2024-04-24T07:15:16Z","snapshot_observed_at":"2026-08-13T00:40:21.417654Z","submitted_at":"2024-04-01T04:21:01Z","title":"From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2404.00906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00906","snapshot_observed_at":"2026-08-06T14:57:07.377228Z","title":"From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models","venue":"cs.CV","work_id":"29a43c63-4245-472a-956e-ee8a1b2bb6ee","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.817174Z"},"links":{"cited_paper":"/paper/2404.00906","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3635d29074d3a0346c0c51b8e40de6a61f0137da00a36e7f8d8b6fbee72be74b","observation_id":"13c86a5d-bfd6-4355-ba66-b2356f171d86","resolution":{"observed_at":"2026-08-06T14:57:07.383206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01929","last_updated":"2024-11-15T20:30:35Z","snapshot_observed_at":"2026-08-13T04:49:24.180482Z","submitted_at":"2024-01-03T19:00:01Z","title":"Dichroic cavity mode splitting and lifetimes from interactions with a ferromagnetic metal","version":4},"cited_work":{"arxiv_id":"2401.01929","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01929","snapshot_observed_at":"2026-08-06T14:57:07.350494Z","title":"Dichroic cavity mode splitting and lifetimes from interactions with a ferromagnetic metal","venue":"cond-mat.mes-hall","work_id":"3a4d9e46-7e15-4861-a074-35999197c6ca","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.822275Z"},"links":{"cited_paper":"/paper/2401.01929","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c483f4ee66abc1d0ba593d95a945aa02911fe236a043b34924fad2ad34556c13","observation_id":"cf69d3a4-dcf2-485f-a310-0cd7f694a459","resolution":{"observed_at":"2026-08-06T14:57:07.356457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10420","last_updated":"2025-02-04T08:14:18Z","snapshot_observed_at":"2026-08-09T13:20:00.486560Z","submitted_at":"2025-02-04T08:14:18Z","title":"Position: Stop Acting Like Language Model Agents Are Normal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10420","snapshot_observed_at":"2026-08-06T14:57:06.827850Z","title":"Position: Stop acting like language model agents are normal agents.arXiv preprint arXiv:2502.10420, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.827850Z"},"links":{"cited_paper":"/paper/2502.10420","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f1ee363b4a5170c04a86715a0dd397ac62cc10351514cd19218139dbb5a6dbf1","observation_id":"da7ce7d5-1f88-400f-b71a-6ad4a2bc369a","resolution":{"observed_at":"2026-08-06T14:57:06.827850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08819","last_updated":"2025-03-05T23:00:57Z","snapshot_observed_at":"2026-08-14T11:22:36.945240Z","submitted_at":"2024-04-12T21:30:06Z","title":"The Illusion of State in State-Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08819","snapshot_observed_at":"2026-08-06T14:57:06.833193Z","title":"The illusion of state in state-space models.arXiv preprint arXiv:2404.08819, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.833193Z"},"links":{"cited_paper":"/paper/2404.08819","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:11468083684b9ff0fbf32ea4bfb7f3729cdd190b517cb04b03dcd52adfc4b0f9","observation_id":"88506cc3-0bc2-4c28-ad0e-e502e65a3106","resolution":{"observed_at":"2026-08-06T14:57:06.833193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T14:57:06.838393Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models, January 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.838393Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f5288b38123b758abc53be8ce28beee0c87326d0802a64371e2cca5757301235","observation_id":"342b2bb9-3a86-4035-ba76-ff087d74e944","resolution":{"observed_at":"2026-08-06T14:57:06.838393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.843816Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in neural information processing systems, 36:11809–11822, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.843816Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:97fc31cf8950d281ba05694de44b6790b3df2f911a898eb917b92c48acaf4f5d","observation_id":"d8f299ec-a635-494c-b359-b66aedde4a9d","resolution":{"observed_at":"2026-08-06T14:57:06.843816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T14:57:06.849365Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.849365Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f01e337a881bf2bc04c9527ebed74e796adeb59aad5ce33e32c7faff8ba8f114","observation_id":"92925f36-7b58-42f9-805f-1c5aec1f6bbc","resolution":{"observed_at":"2026-08-06T14:57:06.849365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.854681Z","title":"Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.854681Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:d595fba62df44f4688add162258fa20ea36868412656b556763c191360d2de1d","observation_id":"00196c89-0ca0-4602-9251-e23e8c0f2a11","resolution":{"observed_at":"2026-08-06T14:57:06.854681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-06T14:57:06.860316Z","title":"Transformers as stochastic optimizers.arXiv preprint arXiv:2305.14314, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.860316Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1497d9c3db26a20802f72af8882aceb0ae4c32b7b48c0d2cda2c39e20ea62d05","observation_id":"b5ac2ec1-4433-42c9-b7f8-85b93680d51f","resolution":{"observed_at":"2026-08-06T14:57:06.860316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.233236Z","title":"Do language models have bayesian brains? distinguishing stochastic and deterministic decision patterns within large language models","venue":null,"work_id":"c54ac4e0-2ec7-4da9-804e-7cb3e304ebd9","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.865678Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:75cc5e46c4677191d1e0a42e3e472b2c5419c72dc35af48086dac315e2e8181a","observation_id":"e2f44cc2-f6ae-4848-8367-9cb6094efe55","resolution":{"observed_at":"2026-08-06T14:57:08.240504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14257","last_updated":"2025-02-08T12:50:42Z","snapshot_observed_at":"2026-08-13T21:16:14.484746Z","submitted_at":"2024-11-21T16:05:58Z","title":"Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14257","snapshot_observed_at":"2026-08-06T14:57:06.871290Z","title":"Do i know this entity? knowledge awareness and hallucinations in language models.arXiv preprint arXiv:2411.14257, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.871290Z"},"links":{"cited_paper":"/paper/2411.14257","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:7bf8e8bdcf13ed46bf400aa5796ff91617cb1b14587eb74aafd179e0e7d11b48","observation_id":"0092c7d4-4ae0-402a-a1ba-e18115443018","resolution":{"observed_at":"2026-08-06T14:57:06.871290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04442","last_updated":"2024-04-05T22:59:02Z","snapshot_observed_at":"2026-08-13T19:08:38.601926Z","submitted_at":"2024-04-05T22:59:02Z","title":"Exploring Autonomous Agents through the Lens of Large Language Models: A Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04442","snapshot_observed_at":"2026-08-06T14:57:06.876711Z","title":"Exploring autonomous agents through the lens of large language models.arXiv preprint arXiv:2404.04442, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.876711Z"},"links":{"cited_paper":"/paper/2404.04442","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:14df3c58e21aace34b9824bf478da1a001855f4a05cf0662223423dff4ef60ef","observation_id":"a81a66a5-757a-4faa-8a14-ebda8925b122","resolution":{"observed_at":"2026-08-06T14:57:06.876711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04528","last_updated":"2024-07-16T07:29:49Z","snapshot_observed_at":"2026-08-13T11:22:30.931589Z","submitted_at":"2023-06-07T15:37:00Z","title":"PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04528","snapshot_observed_at":"2026-08-06T14:57:06.882060Z","title":"PromptBench: Towards evaluating the robustness of Large Language Models on adversarial prompts.arXiv: 2306.04528 [cs.CL], June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.882060Z"},"links":{"cited_paper":"/paper/2306.04528","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b20ecb99dcebf0558c18d635a34a40123ad76bda43052c5b1a65996759479ff7","observation_id":"15fb529e-3caf-4a08-bb0b-0efca3b5e99f","resolution":{"observed_at":"2026-08-06T14:57:06.882060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19177","last_updated":"2023-10-29T22:37:54Z","snapshot_observed_at":"2026-08-13T05:37:59.274856Z","submitted_at":"2023-10-29T22:37:54Z","title":"Robustifying Language Models with Test-Time Adaptation","version":1},"cited_work":{"arxiv_id":"2310.19177","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19177","snapshot_observed_at":"2026-08-06T14:57:07.174741Z","title":"Robustifying Language Models with Test-Time Adaptation","venue":"cs.CL","work_id":"2b7a7792-6f6d-4ab4-bc1c-35740ac39ca3","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.887492Z"},"links":{"cited_paper":"/paper/2310.19177","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4467848a2caaa8f7e5b4dd73c894183275c08030fba0d95eb08861fbc5091697","observation_id":"b5aa7e15-cdf3-4244-9f65-81628866973c","resolution":{"observed_at":"2026-08-06T14:57:07.180393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12237","last_updated":"2021-08-27T12:31:17Z","snapshot_observed_at":"2026-08-12T06:28:31.700767Z","submitted_at":"2021-08-27T12:31:17Z","title":"Evaluating the Robustness of Neural Language Models to Input Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12237","snapshot_observed_at":"2026-08-06T14:57:06.893117Z","title":"Evaluating the robustness of neural language models to input perturbations.arXiv preprint arXiv:2108.12237, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.893117Z"},"links":{"cited_paper":"/paper/2108.12237","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:dfeda910593311742632458f6c3144d0ac82f191064bfa31dc9a8d5739480d95","observation_id":"5ac6a081-2131-489e-aab5-3c81dd804c36","resolution":{"observed_at":"2026-08-06T14:57:06.893117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10802","last_updated":"2024-06-16T04:48:43Z","snapshot_observed_at":"2026-08-14T09:34:58.793098Z","submitted_at":"2024-06-16T04:48:43Z","title":"KGPA: Robustness Evaluation for Large Language Models via Cross-Domain Knowledge Graphs","version":1},"cited_work":{"arxiv_id":"2406.10802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.10802","snapshot_observed_at":"2026-08-06T14:57:07.129292Z","title":"KGPA: Robustness Evaluation for Large Language Models via Cross-Domain Knowledge Graphs","venue":"cs.CL","work_id":"21cc28b8-41f3-4797-9dbc-fbf139359527","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.898735Z"},"links":{"cited_paper":"/paper/2406.10802","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:03f54adbcdc5a1b7a7b42645baf59ba01c95bcf60d157b264318263ec00489c1","observation_id":"3f07845c-48b5-43dd-8869-ee4845427d18","resolution":{"observed_at":"2026-08-06T14:57:07.137196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08851","last_updated":"2024-10-11T14:27:18Z","snapshot_observed_at":"2026-08-12T22:25:23.995376Z","submitted_at":"2024-10-11T14:27:18Z","title":"Measuring the Inconsistency of Large Language Models in Preferential Ranking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08851","snapshot_observed_at":"2026-08-06T14:57:06.905560Z","title":"Measuring the inconsistency of large language models in preferential ranking.arXiv preprint arXiv:2410.08851, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.905560Z"},"links":{"cited_paper":"/paper/2410.08851","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ac90831682c8a1b3c7d049982128521c492ccd1afdc185bc4cf8754b8a242c30","observation_id":"069695b2-e419-4f83-b243-d8af4455dc52","resolution":{"observed_at":"2026-08-06T14:57:06.905560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09624","last_updated":"2023-11-11T05:30:34Z","snapshot_observed_at":"2026-08-13T05:49:19.674766Z","submitted_at":"2023-10-14T17:10:28Z","title":"ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09624","snapshot_observed_at":"2026-08-06T14:57:06.911179Z","title":"Assert: Automated safety scenario red teaming for evaluating the robustness of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.911179Z"},"links":{"cited_paper":"/paper/2310.09624","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f0c63f1466886eeb2220cc41375834fa73835aaed07d566b1b1d555261d212f5","observation_id":"33e30a3e-e233-4d4b-9455-e98db6691ece","resolution":{"observed_at":"2026-08-06T14:57:06.911179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.916840Z","title":"Large language models can be easily distracted by irrelevant context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.916840Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1ad56d6f316864c00be00fca3f58a7503373df48c4b1b9079e280bbfdc711721","observation_id":"53160d10-d113-4d5c-80ca-3e1483657778","resolution":{"observed_at":"2026-08-06T14:57:06.916840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03538","last_updated":"2024-11-05T22:37:43Z","snapshot_observed_at":"2026-08-12T22:06:53.893928Z","submitted_at":"2024-11-05T22:37:43Z","title":"Long Context RAG Performance of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03538","snapshot_observed_at":"2026-08-06T14:57:06.923301Z","title":"Long context rag performance of large language models.arXiv preprint arXiv:2411.03538, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.923301Z"},"links":{"cited_paper":"/paper/2411.03538","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:7f4c48f474eaa5b18d2d821423b6b5fd07ebaae190fc3bc8ee42d7c6a6d5cc2c","observation_id":"8d24e04b-5c05-4f81-8347-4c434e4ca36f","resolution":{"observed_at":"2026-08-06T14:57:06.923301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.928664Z","title":"Lost in the middle: How language models use long contexts.Transactions of the Association for Computational Linguistics, 12:157–173, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.928664Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b6644740695d0b008a703ad214613dd53c4525f98e8fe4d495431e5834e54257","observation_id":"c0c529d7-a28a-4b70-b831-5a3e2e20eb1f","resolution":{"observed_at":"2026-08-06T14:57:06.928664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.188932Z","title":"Computational dualism and objective superintelligence","venue":null,"work_id":"e0524e7c-6f4a-4563-9880-ff974f47597d","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.933739Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4b5e4f95fa99b5471210a1a9bfaf4e26d3ccafa55b6b7ed1f2d3b09f38a3d612","observation_id":"ff543c29-3253-40c5-b5bd-e37b1f23c550","resolution":{"observed_at":"2026-08-06T14:57:08.195060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.171241Z","title":"Are biological systems more intelligent than artificial intelligence? 2025","venue":null,"work_id":"7cadc212-0c50-4d0c-934c-d43b5cd612a5","year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.939038Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:99945cbfa4324b88a770a31c0b000b71479e4daf258b48b53b898810ffde9752","observation_id":"aa3e6cd3-4a6d-47e7-ad1c-2760f91419a5","resolution":{"observed_at":"2026-08-06T14:57:08.176790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.152238Z","title":"Philosophical specification of empathetic ethical artificial intelligence.IEEE Transactions on Cognitive and Developmental Systems, 14(2):292–300, 2022","venue":null,"work_id":"d61d8d2b-d5ee-41b1-9f5e-4c4f6fd6a0c3","year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.943812Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:138d073b6c90b0539bc561bcea07d3b3b04bab499b97c9a71101ca467cf3f72a","observation_id":"7a2d9398-0423-400d-86b8-19aefa192ab0","resolution":{"observed_at":"2026-08-06T14:57:08.158661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.132816Z","title":null,"venue":null,"work_id":"69bcfec8-5918-4bf5-b6ad-cb9ddacf67ce","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.949190Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:65c42d72e0bb9fd204fe04ff8fba35b354465c797f60024dbf0a3d82304cf9d2","observation_id":"507122a8-1b37-403a-b3f8-50df7bced55a","resolution":{"observed_at":"2026-08-06T14:57:08.139110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.114340Z","title":null,"venue":null,"work_id":"9150bc74-629b-4230-b8c4-676cf46c9983","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.954486Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:219e032a2b81aae74b37de2df28fe349721ecea428a992031c0e4dfb647fc7db","observation_id":"e17834ce-3c35-4e96-bf23-288aedb93d66","resolution":{"observed_at":"2026-08-06T14:57:08.120137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.094696Z","title":"De- velop a 3-stage marketing strategy for a new eco-friendly coffee brand,","venue":null,"work_id":"17bd8756-4f7e-44fb-9776-dec7225e5a92","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.960486Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:db23c04c442ef793172bc8cd6e3fabe0652ad34e4159a7e462e7da191ef95f81","observation_id":"e7b478e5-fa0e-4c70-9b2f-7e170ea32c92","resolution":{"observed_at":"2026-08-06T14:57:08.101068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.077274Z","title":"–Perform the standardised planning task","venue":null,"work_id":"02b031fb-f340-4355-8f6f-7799f6781fbf","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.966448Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4109bbaac127bb87e45e74310cbf55019f4dbf19366fd655413769a8e0031ffa","observation_id":"2a7d42a1-3a74-4474-8bc2-b42ea5b98c08","resolution":{"observed_at":"2026-08-06T14:57:08.082506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.058048Z","title":"Planning Performance Scores for Configi)","venue":null,"work_id":"6d2f05a9-e2d6-49fb-b8db-1b8943454319","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.972275Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:aec0fdf164e5bc4eb7b63275bcfe3beeee94efce77beaf34abbef4214b2f91da","observation_id":"a08a87dd-dda9-4de4-964f-62a6da37fcd8","resolution":{"observed_at":"2026-08-06T14:57:08.064659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.034539Z","title":null,"venue":null,"work_id":"9e5a4d1d-2e48-460d-b3f2-848088a946b2","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.978251Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:133ab26fabdbbb2fe503644734f6f92e02384cde6dc043140018dab580fad5e8","observation_id":"953d708c-93c4-4e7d-a751-82584a7b432c","resolution":{"observed_at":"2026-08-06T14:57:08.046352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.013777Z","title":null,"venue":null,"work_id":"614692a6-d9a8-4846-b283-7238ba33a617","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.984262Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2452576cf8ed025337f7bce2b47eb557ae5cda37b1a1137d351b1b3711099fc5","observation_id":"f1d46ca2-af28-4f1f-adf7-84060a0c1d79","resolution":{"observed_at":"2026-08-06T14:57:08.020161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.994959Z","title":"every k ticks","venue":null,"work_id":"8d6d9fd8-4fed-49be-8488-f6866b5da350","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.989789Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ce886c4ec0656d060a523a60240630c3b7918d6e5c20876ad31a5601cffcd41a","observation_id":"ebe7b66b-9a3b-452b-bc7d-ca80c71b002f","resolution":{"observed_at":"2026-08-06T14:57:08.000276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.976177Z","title":"LLMs do not retain information across separate inference instances [ 68, 58]","venue":null,"work_id":"41c44d64-00fb-4638-ba93-0181f233686a","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.996541Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:e2194ff88047cfd2e991b85b31fa80e1c122b984120c7ae6acdabd6cb8a9dd1b","observation_id":"d4870296-af78-41d6-b209-2a9057d762d0","resolution":{"observed_at":"2026-08-06T14:57:07.983099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.956788Z","title":"LLM outputs are typically probabilistic [72, 73, 74], meaning the same query can yield varying or even incorrect results on different runs [ 75]","venue":null,"work_id":"65e4f322-f722-4866-9862-b6c33451deae","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:07.002510Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:bdbaebaac85d9424e695bc50de3045b60a4cb234bfc259dec589a838748537cd","observation_id":"53e6b534-a56c-4092-b748-3d901feaa208","resolution":{"observed_at":"2026-08-06T14:57:07.963009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.939268Z","title":null,"venue":null,"work_id":"3fbf4f81-f334-410a-b961-33faad037109","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:07.008612Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:a772892b88925e78dd0f5f9c0e2027f5180351ccced1471e46f8a5618d0b3f9d","observation_id":"1483fa5c-bb67-46e7-84ba-be185531ebd6","resolution":{"observed_at":"2026-08-06T14:57:07.944459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.920487Z","title":"All interaction with an LLM is text-based: agent definitions, environmental factors, and actions are translated into tokens, which the LLM interprets to produce responses in kind","venue":null,"work_id":"65275893-c2fb-421d-a4a5-b9d0ad6f5828","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:07.014317Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:80e47725c40e71559696ccc533d8fe7ecc614c9b67aad371b3f5f0d2721be686","observation_id":"509b5f59-6a6a-4195-9454-48d853ad1cdb","resolution":{"observed_at":"2026-08-06T14:57:07.926581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":65,"verified_exact":5,"verified_fuzzy":27},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 1 inbound Pith citation observation for arXiv:2507.17257."}