{"as_of":"2026-08-11T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:81ea20e517fc97edc9686938b2cee88d3201ce3348ba678fcc1ee2db6ae741d7","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:43:53.758609Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:44:21.636050Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T10:58:14.019840Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"cited_work":{"arxiv_id":"2501.11067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11067","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intellagent: A multi-agent framework for evaluating conversational ai systems.arXiv preprint arXiv:2501.11067","venue":null,"work_id":"3daa0cca-59e6-4504-8c95-e2644eef2efe","year":2025},"citing_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T07:52:17.174347Z"},"links":{"cited_paper":"/paper/2501.11067","citing_paper":"/paper/2506.07982"},"observation_digest":"sha256:836d0053a54e385483dead818095aeffb9f0994e40fb145392896a579ec08d6f","observation_id":"86576c80-50e8-48f5-b106-d7eb39242f96","resolution":{"observed_at":"2026-05-12T07:52:17.378438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11067","snapshot_observed_at":"2026-08-06T12:44:21.636050Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21504","last_updated":"2025-07-29T04:57:02Z","snapshot_observed_at":"2026-08-06T15:35:42.279155Z","submitted_at":"2025-07-29T04:57:02Z","title":"Evaluation and Benchmarking of LLM Agents: A Survey","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T12:44:21.636050Z"},"links":{"cited_paper":"/paper/2501.11067","citing_paper":"/paper/2507.21504"},"observation_digest":"sha256:d729d40d2119b84ab0c2368be3ce73cb0d7cb4880ab0f7cfcc0ce788ea9b0f92","observation_id":"a7a1f55d-5608-463f-ba76-40eaeb9259b8","resolution":{"observed_at":"2026-08-06T12:44:21.636050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"cited_work":{"arxiv_id":"2501.11067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11067","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intellagent: A multi-agent framework for evaluating conversational ai systems.arXiv preprint arXiv:2501.11067","venue":null,"work_id":"3daa0cca-59e6-4504-8c95-e2644eef2efe","year":2025},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-08-11T09:44:01.811561Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/2501.11067","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:a6abb0c3b9903bf8638907d3035b24b755615ff77d684eac550cf0e62de8da22","observation_id":"988949c2-74aa-4222-9d9f-bdbecac438b3","resolution":{"observed_at":"2026-05-14T23:13:15.534657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"cited_work":{"arxiv_id":"2501.11067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11067","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intellagent: A multi-agent framework for evaluating conversational ai systems.arXiv preprint arXiv:2501.11067","venue":null,"work_id":"3daa0cca-59e6-4504-8c95-e2644eef2efe","year":2025},"citing_paper":{"arxiv_id":"2604.06111","last_updated":"2026-04-10T03:07:44Z","snapshot_observed_at":"2026-08-11T03:14:40.685759Z","submitted_at":"2026-04-07T17:21:28Z","title":"AgentCE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T19:07:46.077831Z"},"links":{"cited_paper":"/paper/2501.11067","citing_paper":"/paper/2604.06111"},"observation_digest":"sha256:01c44284568993a324fc1f5a3d10024444a968b4d1d4f1e696dc85b4bedb5105","observation_id":"2c5c510e-7a6e-4cbd-98c4-77944c47aee0","resolution":{"observed_at":"2026-05-10T23:30:49.458088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"cited_work":{"arxiv_id":"2501.11067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11067","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intellagent: A multi-agent framework for evaluating conversational ai systems.arXiv preprint arXiv:2501.11067","venue":null,"work_id":"3daa0cca-59e6-4504-8c95-e2644eef2efe","year":2025},"citing_paper":{"arxiv_id":"2605.06334","last_updated":"2026-05-07T14:26:19Z","snapshot_observed_at":"2026-08-11T08:31:15.808334Z","submitted_at":"2026-05-07T14:26:19Z","title":"MANTRA: Synthesizing SMT-Validated Compliance Benchmarks for Tool-Using LLM Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T10:18:08.444296Z"},"links":{"cited_paper":"/paper/2501.11067","citing_paper":"/paper/2605.06334"},"observation_digest":"sha256:d77070ec1e338178499acf561b6ce9cde38a1872b941f3e3beee55ffee6ca7ac","observation_id":"83caedcb-f771-4e56-98fc-588ed22b31f6","resolution":{"observed_at":"2026-05-11T20:06:12.706281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"cited_work":{"arxiv_id":"2501.11067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11067","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intellagent: A multi-agent framework for evaluating conversational ai systems.arXiv preprint arXiv:2501.11067","venue":null,"work_id":"3daa0cca-59e6-4504-8c95-e2644eef2efe","year":2025},"citing_paper":{"arxiv_id":"2605.17829","last_updated":"2026-05-18T04:03:18Z","snapshot_observed_at":"2026-08-11T04:15:46.387174Z","submitted_at":"2026-05-18T04:03:18Z","title":"Interactive Evaluation Requires a Design Science","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T10:55:08.135630Z"},"links":{"cited_paper":"/paper/2501.11067","citing_paper":"/paper/2605.17829"},"observation_digest":"sha256:008df4aeda61498ba839eec4e14e5d206bbec9d192c878b8d7881460ccc4b15e","observation_id":"09cbdbfa-b8e1-48e5-93ca-fd187250d11e","resolution":{"observed_at":"2026-05-20T10:58:14.021687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.11067/citation-record","integrity":"/paper/2501.11067/integrity","json":"/paper/2501.11067/citation-record.json","paper":"/paper/2501.11067"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.514781Z","title":"Abbasian, I","venue":null,"work_id":"e3af49bf-ecbc-46dd-a29a-96ae612d6ee1","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.585622Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:cde648452ebb8998b2195885b71da9a7563bf146212c5ed407b9b72071af7143","observation_id":"2ba4f3c6-1653-4bd7-afc4-d98a3676eadb","resolution":{"observed_at":"2026-08-10T18:43:54.519211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.498787Z","title":"Alberts, B","venue":null,"work_id":"6bf4499b-3b3e-4861-b013-10b0dcd1a0e2","year":null},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.591274Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:45b52883821c6fccec3129b2370e7a569ae93060bac80baee8346fc771722d9d","observation_id":"8e19b320-5490-44c1-8ef8-1c6a7d42025a","resolution":{"observed_at":"2026-08-10T18:43:54.503628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15934","last_updated":"2024-10-10T11:37:51Z","snapshot_observed_at":"2026-08-11T01:35:42.276867Z","submitted_at":"2024-09-24T09:57:43Z","title":"Automated test generation to evaluate tool-augmented LLMs as conversational AI agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15934","snapshot_observed_at":"2026-08-10T18:43:53.601467Z","title":"Arcadinho, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.601467Z"},"links":{"cited_paper":"/paper/2409.15934","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:25f01a385134854f9e2e894dcfb44769754e1af34b8af30325aa1b2a7e0b0829","observation_id":"120dbcbf-2850-4000-904c-80afd79c3454","resolution":{"observed_at":"2026-08-10T18:43:53.601467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.475654Z","title":"Banerjee, P","venue":null,"work_id":"d1d27fe7-bcc3-4433-b8bf-b2922f6af07f","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.606452Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:6f84a8a7d3905a339ea7bd5a5050e14c8fa4e5b44315d3c0487e974a14d1e921","observation_id":"ff441c3c-d61e-4cf7-ad9f-4c9654b71a64","resolution":{"observed_at":"2026-08-10T18:43:54.484345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.454927Z","title":"Betker, G","venue":null,"work_id":"80fbacd7-4691-418a-a41a-e801b0146763","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.610857Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:adf30aae26caf57d14e9a16c7e58f3f028eaaee05dc7816a271783564b01355e","observation_id":"864af797-095f-4193-b175-c7128ecd25c5","resolution":{"observed_at":"2026-08-10T18:43:54.463365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20222","last_updated":"2024-10-11T11:32:16Z","snapshot_observed_at":"2026-08-10T22:52:17.561531Z","submitted_at":"2024-09-30T12:01:29Z","title":"Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20222","snapshot_observed_at":"2026-08-10T18:43:53.615356Z","title":"Castillo-Bolado, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.615356Z"},"links":{"cited_paper":"/paper/2409.20222","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:dd65fd1bc58377ab67776b2308bca51419c7f8b90f3e4513105e20e255a05821","observation_id":"d74ba6b3-ff60-4065-8a6e-9d7813c0634e","resolution":{"observed_at":"2026-08-10T18:43:53.615356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.438135Z","title":null,"venue":null,"work_id":"521b2e8b-157b-4a92-83bf-2531601272a7","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.620346Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:5d59183f63c2e47afe9e9e78e762c259d76d7a6bc20f9b78fbb256818f97531b","observation_id":"61e06fcb-7f7a-4d5d-9385-cd696583e928","resolution":{"observed_at":"2026-08-10T18:43:54.443124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.419541Z","title":null,"venue":null,"work_id":"5c1c5699-398d-4d38-9af2-95f78b7cea5c","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.625397Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:012459b0c47bba9d04ff72cf069c1453edb6abc8fe6621cde0000a23df5cf583","observation_id":"b049339d-d601-4158-ba9d-c8d33a785c1a","resolution":{"observed_at":"2026-08-10T18:43:54.424920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.393784Z","title":null,"venue":null,"work_id":"a3e2a776-cbd6-4ba8-ac22-b07b1ab02096","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.629554Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:442da231355bf1025e384e84baed11abcc03e365c055edcd000868781e13ebeb","observation_id":"fa874ec5-b020-4832-bf09-0fe198584fcb","resolution":{"observed_at":"2026-08-10T18:43:54.405510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-08-10T18:43:53.633747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.633747Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:a13d22119ab488e6596e7e80325deee33e2d0e98c4b3b748ae6aa10289eaba7a","observation_id":"9b3e003c-402f-4947-8683-5c397b4e3539","resolution":{"observed_at":"2026-08-10T18:43:53.633747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15217","last_updated":"2025-04-28T05:09:12Z","snapshot_observed_at":"2026-08-05T02:02:34.574070Z","submitted_at":"2023-09-26T19:23:54Z","title":"Ragas: Automated Evaluation of Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15217","snapshot_observed_at":"2026-08-10T18:43:53.638756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.638756Z"},"links":{"cited_paper":"/paper/2309.15217","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:9c557b664fafdf6ff76c49a73c061ef94074a36babe243e46b5bfc552c8b1859","observation_id":"01d5335a-76e4-4e3c-86dc-a0e35381fdef","resolution":{"observed_at":"2026-08-10T18:43:53.638756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-10T21:55:43.802039Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-10T18:43:53.643993Z","title":"Gunasekar, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.643993Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:9ee25c658928a28605ca5d98685dc8d4c9345b52ba36761b48362d36613de447","observation_id":"36365a3f-426d-433c-a472-f8802ac8287a","resolution":{"observed_at":"2026-08-10T18:43:53.643993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.366133Z","title":"Honovich, T","venue":null,"work_id":"df44ee31-afbe-4e61-9427-eeeb41c3b31d","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.648623Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:ad83dd749b0304b642193dec9e7fa595a45783070ec43cb456a353d0b28c0873","observation_id":"64c6518c-741b-4a71-b6d3-7fa10a004813","resolution":{"observed_at":"2026-08-10T18:43:54.372346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.345492Z","title":"Huang, A","venue":null,"work_id":"08b2fc32-945f-4773-914c-b2a758a2b46f","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.652863Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:b2b7d4afac278505d6e5d2efd794ab65c097ece160e62d5ffad47c2961850acc","observation_id":"94f1e61d-d4f0-4048-af9a-6dde17e90960","resolution":{"observed_at":"2026-08-10T18:43:54.350687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.328253Z","title":null,"venue":null,"work_id":"a1c1c7d4-5b71-4ecc-a539-c6893bee4705","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.657300Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:f8db86d192cd5e04f95d7507283d90b7fb6f83c9bfcd22757950a4990d67b505","observation_id":"1265742e-3035-4112-a623-6c0a5fbcc07d","resolution":{"observed_at":"2026-08-10T18:43:54.332770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.301530Z","title":null,"venue":null,"work_id":"1023688d-9948-420e-9835-53f639ccca12","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.666256Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:c757a84175ef0421d4a448651d6d69781f438cf1d540b0b4ccc369a949f599e1","observation_id":"e3ecfb34-d7d3-4499-958f-bde26121fc88","resolution":{"observed_at":"2026-08-10T18:43:54.306040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.282839Z","title":null,"venue":null,"work_id":"1ec4f705-7950-4fe9-b3f7-8a8bda942d94","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.670747Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:c6f30f662038c90b4afb8adbd70a05b747df0905f8a238557a9cee391eac90ad","observation_id":"488ce502-6b20-4306-870b-e4c6c61fdb25","resolution":{"observed_at":"2026-08-10T18:43:54.287378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-10T18:43:53.675025Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.675025Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:e6f4f4836ae960289920ee6ceba230587c0537da20db304bb2c43793974dc903","observation_id":"60f0898c-7fb5-4aa1-afed-a6897b43d296","resolution":{"observed_at":"2026-08-10T18:43:53.675025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.264361Z","title":null,"venue":null,"work_id":"e02ad42f-e398-45c9-a370-8c8899717886","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.680513Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:c25b04634c1ee5ebd3e99b95e1662863f12e6e5e06608564e8d0a95f644cdf32","observation_id":"49aa8bb6-05a1-417e-a40a-f159e73c3385","resolution":{"observed_at":"2026-08-10T18:43:54.269950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.238387Z","title":"Mehandru, B","venue":null,"work_id":"05e84abc-5239-4afa-beeb-f3dc93bff96a","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.685350Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:ffeeedc636a47fd554f061e22127585b63f692ec6d68b1ba1df4a113fbd7f3b1","observation_id":"3d32d8a9-f40d-489c-bbc1-35ab0242d00c","resolution":{"observed_at":"2026-08-10T18:43:54.243261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.220918Z","title":"ask me anything","venue":null,"work_id":"2250b7a6-82a9-4a62-995f-5905f8d36442","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.690380Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:73c284b1e571c32a08f9efc758627ce19824aa588b1e9fce234b7de545245f2b","observation_id":"d04fcc82-1da6-4221-98a9-ce0c1b7707df","resolution":{"observed_at":"2026-08-10T18:43:54.226019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-10T18:43:53.695662Z","title":"Rozière, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.695662Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:77d5a1cf7d90e0a4d0603dcf030372f2c2bd511c68f880ec6a1b4251ec1b2b0f","observation_id":"1f7f464f-9d8a-4775-93b9-3c8f27541608","resolution":{"observed_at":"2026-08-10T18:43:53.695662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.204012Z","title":null,"venue":null,"work_id":"42934da0-c632-400e-8385-217cde174a79","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.701862Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:d79d6640b90fc1c5755810e4f34b9957435794c5d99f2fc5f95ff64b6549ffd3","observation_id":"daa89ba4-b4a8-4baa-9627-b0be7f0553fa","resolution":{"observed_at":"2026-08-10T18:43:54.209531Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00368","last_updated":"2024-05-31T07:22:01Z","snapshot_observed_at":"2026-08-10T01:59:33.502428Z","submitted_at":"2023-12-31T02:13:18Z","title":"Improving Text Embeddings with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00368","snapshot_observed_at":"2026-08-10T18:43:53.707147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.707147Z"},"links":{"cited_paper":"/paper/2401.00368","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:b6fd67ffe82a6ed78401850ca16f005add77ae536c11272308c8249969f9f256","observation_id":"f9da4632-408c-4d34-a357-239a4c69b480","resolution":{"observed_at":"2026-08-10T18:43:53.707147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.175458Z","title":null,"venue":null,"work_id":"1fea700c-112c-49d5-aa18-effd39b3d3f6","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.712319Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:b6d958ae21188762113e6cbfc5b3a13059f6e0afd2718a38622ff6c594e60021","observation_id":"0b9b9dba-1484-4a94-bfb2-aba6f1354e9e","resolution":{"observed_at":"2026-08-10T18:43:54.186295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.155686Z","title":null,"venue":null,"work_id":"0f04436c-eb7c-460d-9301-bfed5f87d242","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.717373Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:c0e6dd36acd266127485c519b2d75fd17f3ecd1fe74d266123e1d67c3b9716ef","observation_id":"3da4173e-3865-4609-b6e3-fb97e98a4151","resolution":{"observed_at":"2026-08-10T18:43:54.162347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.132021Z","title":null,"venue":null,"work_id":"4a081536-db37-4721-b6ff-efdb0cb1eb54","year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.722808Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:1104b43d5034a26e540920cd19c5bd4b0d4677fb2ab92e07ffb3eb70268580c3","observation_id":"5d967670-e111-45fe-b511-3f2f4a436c41","resolution":{"observed_at":"2026-08-10T18:43:54.138827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00287","last_updated":"2025-01-24T23:46:07Z","snapshot_observed_at":"2026-08-09T21:12:28.293855Z","submitted_at":"2023-11-01T04:37:28Z","title":"Knowledge-Infused Prompting: Assessing and Advancing Clinical Text Data Generation with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00287","snapshot_observed_at":"2026-08-10T18:43:53.727559Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.727559Z"},"links":{"cited_paper":"/paper/2311.00287","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:822b0f19f9cc00990acfed12ef1f8a71d7d65184b59423660f7e3e931b143e61","observation_id":"40742cb0-949e-4874-af72-80a351e560f8","resolution":{"observed_at":"2026-08-10T18:43:53.727559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.113024Z","title":null,"venue":null,"work_id":"6ef858c4-ddfa-4379-b51b-a7260ed5b618","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.732284Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:43725f5e3bee601de9823928f826bf0b5d522e6677eccfc91e9bca8373c8f36e","observation_id":"14f01197-372c-4fd4-8b67-f22acea2ab26","resolution":{"observed_at":"2026-08-10T18:43:54.117460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.095991Z","title":null,"venue":null,"work_id":"43f608ba-cb5b-4086-83ca-79d98436adf2","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.736454Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:f6f6f0cec9ad721a0db2d1a6080d785a21ce05c498b15b5fc77054042c038b0b","observation_id":"9eb16bd0-ee2d-45ca-bfb8-b2a633bf0965","resolution":{"observed_at":"2026-08-10T18:43:54.100916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.078483Z","title":null,"venue":null,"work_id":"45f75255-5d79-469b-b8bf-4627d0872de6","year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.740603Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:b0ff456e44b482813b817bdf663508818a65ea631497ceacccfb3c8c8b89b799","observation_id":"6a5161df-fd22-4128-9b46-865d102df32d","resolution":{"observed_at":"2026-08-10T18:43:54.084321Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02418","last_updated":"2023-12-05T01:19:30Z","snapshot_observed_at":"2026-08-10T07:21:45.884226Z","submitted_at":"2023-12-05T01:19:30Z","title":"Decoding Data Quality via Synthetic Corruptions: Embedding-guided Pruning of Code Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02418","snapshot_observed_at":"2026-08-10T18:43:53.744625Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.744625Z"},"links":{"cited_paper":"/paper/2312.02418","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:9842b49ae379483d77a2ca5c3cfb30eab2b6475000d75a61587eae064afdc156","observation_id":"0de91527-b830-48fc-8c69-50cfb4d73481","resolution":{"observed_at":"2026-08-10T18:43:53.744625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-08T21:08:39.676079Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-10T18:43:53.749066Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.749066Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:787df72cce2e55125facfb86691030ba7c109e6af12fe80951d5fb166758e1bc","observation_id":"9a10d60b-cd69-4c72-92e0-2e03143d1744","resolution":{"observed_at":"2026-08-10T18:43:53.749066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-10T18:43:53.753467Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.753467Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:c662b6f5740a93ce9797ff1a0cc3073f78b2bc4d9a33f9cf2011be9b71083363","observation_id":"5000dc8e-e6bf-4ded-beee-a4497e09c9c3","resolution":{"observed_at":"2026-08-10T18:43:53.753467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:54.058364Z","title":"emma_jones_4829","venue":null,"work_id":"9b7bc45f-a0f1-4d59-a3fc-1adf6a3ac8ac","year":null},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.758609Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:08c225a95a92fede5b415546d581d2d95ab4944938eb4319142f484d8d254434","observation_id":"3fec2bc5-ec90-40d2-bac9-07c4bc745788","resolution":{"observed_at":"2026-08-10T18:43:54.065905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:53.661698Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.661698Z"},"links":{"citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:1676ebf0407f9fa7494771d3b39120af9335b64181a0bc6c9eb6d33065392197","observation_id":"d89cc873-7c03-45fc-90e6-c5305e40d624","resolution":{"observed_at":"2026-08-10T18:43:53.661698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21159","last_updated":"2025-01-30T01:29:03Z","snapshot_observed_at":"2026-08-10T18:24:06.679427Z","submitted_at":"2024-10-28T15:59:31Z","title":"CURATe: Benchmarking Personalised Alignment of Conversational AI Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21159","snapshot_observed_at":"2026-08-10T18:43:53.596538Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:53.596538Z"},"links":{"cited_paper":"/paper/2410.21159","citing_paper":"/paper/2501.11067"},"observation_digest":"sha256:38183568527f393e36f307975a2f4952e9231b295b7bad8a132d0f8842564ed8","observation_id":"f286962b-0d7c-4bec-9432-9990d2373b5b","resolution":{"observed_at":"2026-08-10T18:43:53.596538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.11067","last_updated":"2025-01-19T14:58:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T15:38:18.564930Z","submitted_at":"2025-01-19T14:58:35Z","title":"IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 6 inbound Pith citation observations for arXiv:2501.11067."}