{"as_of":"2026-08-10T14:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:215a889a567bb4efd6ab82cfe153af7ad9bd8021af629415ac93df4a618a0760","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:22:52.659590Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01361/citation-record","integrity":"/paper/2608.01361/integrity","json":"/paper/2608.01361/citation-record.json","paper":"/paper/2608.01361"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:50.949166Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:50.949166Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:5fc66e2bc1f71313ca526bb521890d82b5abe1e0cf1732820fe902dabdd1e3c0","observation_id":"339f993f-7e5b-45c1-adf5-dd5f44a42603","resolution":{"observed_at":"2026-08-06T00:22:50.949166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29889","last_updated":"2026-05-28T13:14:17Z","snapshot_observed_at":"2026-08-09T11:11:42.506429Z","submitted_at":"2026-05-28T13:14:17Z","title":"Internal Representation, Not Clinical Knowledge: Where Apparent LLM Triage Failures Originate","version":1},"cited_work":{"arxiv_id":"2605.29889","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.29889","snapshot_observed_at":"2026-08-06T00:22:53.624553Z","title":"Internal Representation, Not Clinical Knowledge: Where Apparent LLM Triage Failures Originate","venue":"cs.CL","work_id":"9b1271d8-a200-4fe8-88d3-feca122b23dd","year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.036948Z"},"links":{"cited_paper":"/paper/2605.29889","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:162984b42daacc0c42e0fe445c79abc5cd655096e20e654dc949eb92f34ebeba","observation_id":"f8640ecb-9247-4de9-9972-f3eded215827","resolution":{"observed_at":"2026-08-06T00:22:53.695924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.847434Z","title":"Limitations of large language models in clinical problem-solving arising from inflexible reasoning, Nov 2025","venue":null,"work_id":"5e28313f-579d-4966-91ec-a8d8a1ece194","year":2025},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.072083Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:806188274e07f5101756cce9b028308aeb59ecb7be383eb7eb950b87d5e5d783","observation_id":"e13f29b6-9194-44e2-97f9-8c16f3a60d43","resolution":{"observed_at":"2026-08-06T00:22:53.850660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.839116Z","title":"Evaluating large language model workflows in clinical decision support for triage and referral and diagnosis, May 2025","venue":null,"work_id":"4c0a6937-6c94-4a85-a303-ad168f6ac75c","year":2025},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.126525Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:ce8fd431557df2caf821b6e588d664476bdb6870e4dabb9f5cecae44eaf43bd3","observation_id":"1f6c86f2-7477-4d7a-9ef0-e9cc5d80f773","resolution":{"observed_at":"2026-08-06T00:22:53.842343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:51.197771Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.197771Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:dab6867ece798f41134bd61d855960d839ac942fe17f0ee0a60584a8392bfad7","observation_id":"68214dc7-8a1b-4f5b-b1ca-2e5ab51126b7","resolution":{"observed_at":"2026-08-06T00:22:51.197771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.64898/2026.03.23.26349082","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Auger and Gregory Scott","venue":"medRxiv","work_id":"02317895-b233-4ef2-9929-30054c78f2c7","year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.252667Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:cf6b380b22160b6f9a713e13ea73fc708375fd4e03cbdec2bd74ef1c5ee2f1e5","observation_id":"8f3e9f52-b64e-4f9d-aa92-79e1b81b516d","resolution":{"observed_at":"2026-08-06T00:22:53.161413Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:51.315246Z","title":"Meuth, Lennert Böhm, and Marc Pawlitzki","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.315246Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:5b63ad073ac8eaf6351376e655f565654482a31dd486f3506713c96cfb4db3a0","observation_id":"9e0c27b5-c405-4bc4-96dd-ab561f8df717","resolution":{"observed_at":"2026-08-06T00:22:51.315246Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:51.351416Z","title":"Te, Steven A","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.351416Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:483fdb06e8cadfb5f5157309329f573fe9b7b9545ff0e6c1494e0fda545fef27","observation_id":"03a263da-6029-4d54-b388-68203b5f2c10","resolution":{"observed_at":"2026-08-06T00:22:51.351416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.830679Z","title":"Princeton University Press, Princeton, NJ, USA, 1944","venue":null,"work_id":"d92ade90-93c3-4705-b5a0-c62953388e8c","year":1944},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.405895Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:3f5e695416c27d265f6fb48939c905f1dfcfd257d47053eba71344f05beee8d3","observation_id":"f14cb947-2a0c-4a8a-93f8-be2e7183735a","resolution":{"observed_at":"2026-08-06T00:22:53.833517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.821397Z","title":"Courier Corporation, 1972","venue":null,"work_id":"b316aee1-7af1-4356-9673-d94234055ad0","year":1972},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.459968Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:b7e7c2775352e7f3d2864cfbd7112ce3ac005e1bb56d7723f9c586e934d54e27","observation_id":"1626f4d9-4eac-4901-a3c5-0433c9906f93","resolution":{"observed_at":"2026-08-06T00:22:53.824620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.812396Z","title":"Decision theory in expert systems and artificial intelligence.International journal of approximate reasoning, 2(3):247–302, 1988","venue":null,"work_id":"4a6022d7-fda7-4e12-b907-f7ced490cf83","year":1988},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.522120Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:2432ddf3f062d34cfdb1bcd941a13d7da5bc1b85b4a55fd5543aabe0ff7534cd","observation_id":"da09db5c-e822-4f6a-8abc-120413753d80","resolution":{"observed_at":"2026-08-06T00:22:53.815607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1371/journal.pone.0109264","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Mack, George Ruiz, Mark S","venue":"PLoS ONE","work_id":"218ce646-acfe-4d3f-83b8-f8b2f3c37c45","year":null},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.569291Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:624c0d096f16f00d00203f8371ab5fda5aaac4e96f7e5669cf3c84b93294002a","observation_id":"f9d4aed5-a6e0-42e0-9172-6517ee2a8f5c","resolution":{"observed_at":"2026-08-06T00:22:52.932755Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08640","last_updated":"2025-02-19T06:48:30Z","snapshot_observed_at":"2026-08-07T23:55:35.740041Z","submitted_at":"2025-02-12T18:55:43Z","title":"Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08640","snapshot_observed_at":"2026-08-06T00:22:51.629659Z","title":"Lee, Richard Ren, Long Phan, Norman Mu, Adam Khoja, Oliver Zhang, and Dan Hendrycks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.629659Z"},"links":{"cited_paper":"/paper/2502.08640","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:3d5250e811d7a2b556c6c46adfb2f2441196e9e4c820690f019348f813d675b3","observation_id":"7d439f97-8436-49ae-95b7-198d6cf38925","resolution":{"observed_at":"2026-08-06T00:22:51.629659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:51.689462Z","title":"When do llm preferences predict downstream behavior?, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.689462Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:14c7c3826d3f9e5416424b53775407204655e8a73ea42de8cbfa4299b28fc5ec","observation_id":"a65c4fb5-7657-47f5-b86b-de2e08af1f48","resolution":{"observed_at":"2026-08-06T00:22:51.689462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:51.782963Z","title":"Generative value conflicts reveal llm priorities, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.782963Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:7055f6f9fa2e1e60b5c7561717cbce5e8fff8f23aebba1167dd95a90672ebe28","observation_id":"67ea7748-f1e6-483b-86af-060fded84304","resolution":{"observed_at":"2026-08-06T00:22:51.782963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11615","last_updated":"2025-05-16T18:23:10Z","snapshot_observed_at":"2026-08-07T15:44:33.054772Z","submitted_at":"2025-05-16T18:23:10Z","title":"Steering Risk Preferences in Large Language Models by Aligning Behavioral and Neural Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11615","snapshot_observed_at":"2026-08-06T00:22:51.856819Z","title":"Griffiths","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.856819Z"},"links":{"cited_paper":"/paper/2505.11615","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:47cee169e942b3edcb3b56bb9c319274c6419a533c265f277fceb47ad8fae15c","observation_id":"1ba6ebd8-f0f1-4214-8f72-164936310690","resolution":{"observed_at":"2026-08-06T00:22:51.856819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01168","last_updated":"2025-06-10T16:33:51Z","snapshot_observed_at":"2026-07-06T18:24:17.711867Z","submitted_at":"2024-06-03T10:05:25Z","title":"AI as Decision-Maker: Ethics and Risk Preferences of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01168","snapshot_observed_at":"2026-08-06T00:22:51.898643Z","title":"Ai as decision-maker: Ethics and risk preferences of llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.898643Z"},"links":{"cited_paper":"/paper/2406.01168","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:5bad4385ab64302454a170c6f2428b10733bb5808fcfa3b2afa802fa4a91e140","observation_id":"363f25e3-7062-4929-a6ae-63dda012c0b2","resolution":{"observed_at":"2026-08-06T00:22:51.898643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.802942Z","title":"When agents say one thing and do another: Validating elicited beliefs from llms,","venue":null,"work_id":"a4b349e4-f7b6-426d-a97c-c9972d0654c0","year":null},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:51.990160Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:7d02ba5fcd58b455ace0222285c0b1231ff6ea90c6122141df97b83963716990","observation_id":"ee73d049-af65-44e7-881d-ba4f36d20344","resolution":{"observed_at":"2026-08-06T00:22:53.806125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08556","last_updated":"2026-05-08T23:26:35Z","snapshot_observed_at":"2026-07-06T23:20:47.880233Z","submitted_at":"2026-05-08T23:26:35Z","title":"Can Revealed Preferences Clarify LLM Alignment and Steering?","version":1},"cited_work":{"arxiv_id":"2605.08556","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08556","snapshot_observed_at":"2026-08-06T00:22:53.251059Z","title":"Can Revealed Preferences Clarify LLM Alignment and Steering?","venue":"cs.LG","work_id":"6d31bf47-f9a0-4996-91a5-d2937486b014","year":2026},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.111735Z"},"links":{"cited_paper":"/paper/2605.08556","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:ac4cb653e9b5276d5cd2cc2fd32a0294260cd82c0910cbc6e5d0eb4e72a29728","observation_id":"72767926-6ef4-4de7-ace8-fd2d208d6bf3","resolution":{"observed_at":"2026-08-06T00:22:53.328619Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.794399Z","title":"Evaluating language models as risk scores.Advances in Neural Information Processing Systems, 37:97378–97407, 2024","venue":null,"work_id":"28db8134-5b49-4e4c-83c7-b8433cc0a0bf","year":2024},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.158294Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:3d9281bb1bed2b35f8cce0ba1f76b6b3da075e0d16365e9e0b4caedecc9a7949","observation_id":"d86493f6-3582-47fb-86d4-6620e742f54b","resolution":{"observed_at":"2026-08-06T00:22:53.797541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:52.260728Z","title":"Rethink reporting of evaluation results in ai.Science (New York, N.Y.), 380:136–138, 04 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.260728Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:3c6263e7568fed43084f222b7448751c32a08e7829a092439bc2faf1a593dc48","observation_id":"47cbf69f-6692-4403-9a66-1d109d3caf1b","resolution":{"observed_at":"2026-08-06T00:22:52.260728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.785717Z","title":"Mediq: Question-asking llms and a benchmark for reliable interactive clinical reasoning.Advances in Neural Information Processing Systems, 37:28858–28888, 2024","venue":null,"work_id":"30b45d3c-c9aa-425e-8ecd-320a39d3d8a1","year":2024},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.383269Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:5c47a59bc24e435a55fa9e34336a9d29be9a1f7263ae9282e3eebb6947dfeaa9","observation_id":"a8bf71b0-6a56-4523-b75a-9be9cc30836a","resolution":{"observed_at":"2026-08-06T00:22:53.788886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12830","last_updated":"2024-09-30T11:15:24Z","snapshot_observed_at":"2026-07-06T18:33:11.370375Z","submitted_at":"2024-06-18T17:51:24Z","title":"What Are the Odds? Language Models Are Capable of Probabilistic Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12830","snapshot_observed_at":"2026-08-06T00:22:52.449325Z","title":"What are the odds? language models are capable of probabilistic reasoning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.449325Z"},"links":{"cited_paper":"/paper/2406.12830","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:6f418c7cac058ba8ba4b97974b8b2c2d3e580cf3ef6443617d93fe7f015d8da0","observation_id":"d4421907-f3f1-4f1c-b6f0-c2682329571a","resolution":{"observed_at":"2026-08-06T00:22:52.449325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.776431Z","title":"Conditional logit analysis of qualitative choice behavior.Frontiers in Econometrics, pages 105–142, 1973","venue":null,"work_id":"990ccd65-0698-4588-b1b9-6363f1577e5c","year":1973},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.590960Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:a2f08a379f44f9df40dfe9559e12c38742ef8a26a2c3789230839256ec1bc6c0","observation_id":"2e90eb7f-46e2-443e-b42b-21ed005c03bb","resolution":{"observed_at":"2026-08-06T00:22:53.779610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:22:53.767052Z","title":"refer to emergency care whenever the model’s elicited probability exceeds the corresponding decision threshold","venue":null,"work_id":"cea383ba-773c-4a03-913f-529936fc1abb","year":2009},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.659590Z"},"links":{"citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:dba37aaf64c8a3a5c089c4d7bd2755cb81866dc784b38817de4e9d6dca9a960e","observation_id":"6a09ac76-4e9d-4adf-880f-8970abd8b4cd","resolution":{"observed_at":"2026-08-06T00:22:53.770098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06286","last_updated":"2026-05-08T23:20:52Z","snapshot_observed_at":"2026-07-06T22:44:46.690576Z","submitted_at":"2026-02-06T00:50:33Z","title":"When Agents Say One Thing and Do Another: Validating Elicited Beliefs from LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06286","snapshot_observed_at":"2026-08-06T00:22:52.077785Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T00:22:52.077785Z"},"links":{"cited_paper":"/paper/2602.06286","citing_paper":"/paper/2608.01361"},"observation_digest":"sha256:85e0ac256f5e6b049cfd122c2745ab2adaded27d48d5cb86554445362bf6f0f7","observation_id":"64f54d2b-a9a7-4421-8a44-2b2e207acd64","resolution":{"observed_at":"2026-08-06T00:22:52.077785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01361","last_updated":"2026-08-02T16:25:08Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T11:11:40.525551Z","submitted_at":"2026-08-02T16:25:08Z","title":"High-Stakes Decisions with Language Models: Insights from Emergency Triage"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":4,"verified_fuzzy":10},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2608.01361."}