{"as_of":"2026-08-23T08:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed9ac29e6fc950a185d90c9394ddfe99290062cae1531d7c584c379935dfaa66","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:00:26.218590Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12266/citation-record","integrity":"/paper/2506.12266/integrity","json":"/paper/2506.12266/citation-record.json","paper":"/paper/2506.12266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.358802Z","title":null,"venue":null,"work_id":"6aae239f-85ca-4437-9c36-00d2c6740dfa","year":2020},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.372714Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:d06625039dd1b97cf10ed2a80a3d24044fed78e84c3087de6335160e032c7ff5","observation_id":"92fca5e4-5dba-4953-92f5-b6b871cdcaf6","resolution":{"observed_at":"2026-08-07T01:00:28.431580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06556","last_updated":"2023-08-03T15:31:50Z","snapshot_observed_at":"2026-08-21T23:27:37.649729Z","submitted_at":"2023-04-13T14:03:14Z","title":"Are LLMs All You Need for Task-Oriented Dialogue?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06556","snapshot_observed_at":"2026-08-07T01:00:24.978197Z","title":"V ojtˇech Hudeˇcek and Ondˇrej Dušek","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:24.978197Z"},"links":{"cited_paper":"/paper/2304.06556","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:45d9820fc8a1ca79b542d62726915926dc34a4b978d8ba60a049a8cf8462285b","observation_id":"c73e1495-cefe-434e-af8c-9346d1485ed1","resolution":{"observed_at":"2026-08-07T01:00:24.978197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.805930Z","title":"The agent provides information about the restaurant, such as its name, location, cuisine, price, rating, etc","venue":null,"work_id":"8dd6ea24-531e-4ae7-88e8-dacacd3ff980","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.758620Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:d5c686f420fb40fa09fee83a2aea97ebeae245f60d98a27f458d8dc3a4e8e59a","observation_id":"360be9e6-0f3b-4aec-acef-f2d6375f7a11","resolution":{"observed_at":"2026-08-07T01:00:27.868431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.501990Z","title":"The agent provides information about the booking, such as the restaurant name, reservation date, reservation time, number of guests, price, etc","venue":null,"work_id":"eb3317ae-05fa-4378-a184-0b6999c4bd93","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.848139Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:116827ab3d21814af9d37273c05c25377f50ab174126ceb716aa33ffd5c5f317","observation_id":"0e8782f8-6744-4f8f-a9b3-3b1918f925ca","resolution":{"observed_at":"2026-08-07T01:00:27.641289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.565310Z","title":"In Pro- ceedings of the AAAI Conference on Artificial Intelli- gence, volume 38, pages 19368–19376","venue":null,"work_id":"02972b62-8112-4098-9a5e-38611aed3690","year":2022},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.202303Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:c4c60f899077b282ab9177bebe43436ed3ee3a9e1725e12791585a7e452248a6","observation_id":"f4a9bd9f-5156-4201-9817-8f8e00700d7a","resolution":{"observed_at":"2026-08-07T01:00:28.640842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.209721Z","title":"I recommend","venue":null,"work_id":"f05de700-cb75-4ba8-9f6f-6b2940cf3eab","year":2021},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.483359Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:b567abadc3055c0128743a816e766609fabb0c21f445d5dc9f30fa1cfadf080c","observation_id":"6f07d45b-8fa8-48a4-a794-ce02af45fdad","resolution":{"observed_at":"2026-08-07T01:00:28.266621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.072697Z","title":"The agent provides information about the hotel, such as its name, location, price, rating, etc","venue":null,"work_id":"7a8ccc2a-d9ce-4516-ac2f-063eaf06dfd3","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.565442Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:744efae47e04278efd0231c3ca22dd0bfa1249b64793495277a76466b1d96675","observation_id":"84f4b4b2-0e56-487e-a367-2f7fcf62cc9c","resolution":{"observed_at":"2026-08-07T01:00:28.117312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.962915Z","title":"The agent may provide information about the booking, such as the hotel name, check-in date, check-out date, number of guests, price, etc","venue":null,"work_id":"424fdb29-489e-4a4a-af00-6c0a0d601824","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.645908Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:3d0debffadcfdd2a6c757e0b431c717b1e467ab68765ffdaec33ce8897ed3168","observation_id":"61a68466-e2e5-48dc-8889-8067c13568a8","resolution":{"observed_at":"2026-08-07T01:00:28.006217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.363575Z","title":null,"venue":null,"work_id":"e7a862cb-d7e3-49b0-b165-ac570dbbd0e5","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.928658Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:896fdacb7461d92879244be2f25006e21e6fb3db8904fbfc22cb826eb3f4f7d1","observation_id":"faa85dfa-a5c4-4586-b252-da26cc5fca5c","resolution":{"observed_at":"2026-08-07T01:00:27.432617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.199418Z","title":null,"venue":null,"work_id":"ccb39b72-12bf-4ba7-ad86-0cc9ce8146e3","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:26.056784Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:454df5cf5ec950d9880f83870a4ce1527e45eb635ebe63b9760538868dab5711","observation_id":"66106c79-9376-434b-b8ab-61dd60d2adc4","resolution":{"observed_at":"2026-08-07T01:00:27.275164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.002239Z","title":null,"venue":null,"work_id":"51df958f-45ff-4a6a-8137-fac9a8176ca4","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:26.148815Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:7076475d068b7b042618b13ac3138c5da82c8cce3a8bd72b357817186647034b","observation_id":"09249914-84d2-44fd-b075-c767a326e6c1","resolution":{"observed_at":"2026-08-07T01:00:27.104917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:26.820205Z","title":null,"venue":null,"work_id":"26e6e8dc-f951-4c01-b8d7-2f75c2f3ff24","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:26.218590Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:92d0d3123ec1a1ec9d0a4ba4e25c2835a8760dfc7362251981b449fae3b3c0c9","observation_id":"a2d4de67-a31f-4cc7-af26-6233bb852452","resolution":{"observed_at":"2026-08-07T01:00:26.909431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.12720","last_updated":"2020-07-10T22:52:14Z","snapshot_observed_at":"2026-08-18T14:57:58.386382Z","submitted_at":"2020-07-10T22:52:14Z","title":"MultiWOZ 2.2 : A Dialogue Dataset with Additional Annotation Corrections and State Tracking Baselines","version":1},"cited_work":{"arxiv_id":"2007.12720","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.12720","snapshot_observed_at":"2026-08-07T01:00:26.381022Z","title":"MultiWOZ 2.2 : A Dialogue Dataset with Additional Annotation Corrections and State Tracking Baselines","venue":"cs.CL","work_id":"9431103b-b69e-4165-b453-bf72dc7f0f31","year":2020},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.298039Z"},"links":{"cited_paper":"/paper/2007.12720","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:f0616eaf0e693ecec9088b2fc04635b2ac27ea7fb588da2cecb5ae50514a202f","observation_id":"2c509012-5ba4-4d9d-a3e7-f6dbcccb3ae4","resolution":{"observed_at":"2026-08-07T01:00:26.473756Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05855","last_updated":"2020-01-29T18:57:49Z","snapshot_observed_at":"2026-08-19T23:40:05.051429Z","submitted_at":"2019-09-12T17:57:57Z","title":"Towards Scalable Multi-domain Conversational Agents: The Schema-Guided Dialogue Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05855","snapshot_observed_at":"2026-08-07T01:00:25.045981Z","title":"Advances in neural in- formation processing systems, 35:27730–27744","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.045981Z"},"links":{"cited_paper":"/paper/1909.05855","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:820f90fe0cef3b479eeed4ba25d8681c888ee19d50090a5df4533ae44f0b32e0","observation_id":"70420777-962f-4172-bb15-c0df4ebfc55f","resolution":{"observed_at":"2026-08-07T01:00:25.045981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16798","last_updated":"2023-05-26T10:19:30Z","snapshot_observed_at":"2026-08-16T15:29:22.995770Z","submitted_at":"2023-05-26T10:19:30Z","title":"Schema-Guided User Satisfaction Modeling for Task-Oriented Dialogues","version":1},"cited_work":{"arxiv_id":"2305.16798","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16798","snapshot_observed_at":"2026-08-07T01:00:26.636201Z","title":"Schema-Guided User Satisfaction Modeling for Task-Oriented Dialogues","venue":"cs.CL","work_id":"be8b3a92-35b1-4c3b-a10e-83bb78961bf4","year":2023},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:24.903706Z"},"links":{"cited_paper":"/paper/2305.16798","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:5c1ee3bf6c476f3b2138aa4708ac094519182ae97ed711cdedea25463037e78b","observation_id":"8a2e5c0f-5409-499d-9706-7afdec5088a7","resolution":{"observed_at":"2026-08-07T01:00:26.705272Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T01:00:25.117681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.117681Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:81b4fe8e32f30114527cc4c72ad6ab53f120a613eff926bdf88c2e6072e244ab","observation_id":"0fd396b2-f666-4ce0-9509-1fc611b62bcb","resolution":{"observed_at":"2026-08-07T01:00:25.117681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T23:40:46.790897Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2506.12266."}