{"as_of":"2026-08-15T21:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:688310a40f20eb46510f8e9765275df9486eec301dcf3e3c64db9b478770f3f0","coverage":[{"denominator":127,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:54:44.405028Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:09:42.307732Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T00:31:24.688676Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08181","snapshot_observed_at":"2026-08-04T18:09:42.307732Z","title":"Challenges in guardrailing large language models for science[EB/OL]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10208","last_updated":"2025-09-12T12:56:14Z","snapshot_observed_at":"2026-08-12T22:25:48.060683Z","submitted_at":"2025-09-12T12:56:14Z","title":"SI-FACT: Mitigating Knowledge Conflict via Self-Improving Faithfulness-Aware Contrastive Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:09:42.307732Z"},"links":{"cited_paper":"/paper/2411.08181","citing_paper":"/paper/2509.10208"},"observation_digest":"sha256:377610898722aa74dde7bb04f77f749ae1ca0c116a4356b47f520117f2ead621","observation_id":"f2cfc8ab-0a68-4c82-8443-0e5c18e0ba3e","resolution":{"observed_at":"2026-08-04T18:09:42.307732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"cited_work":{"arxiv_id":"2411.08181","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.08181","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Challenges in Guardrailing Large Language Models for Science","venue":null,"work_id":"9bf533d2-d5f5-4776-b7d1-ab89729e7dd2","year":2024},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":2},"reference_index":225,"source":"pdf_text","source_observed_at":"2026-05-17T00:29:07.951709Z"},"links":{"cited_paper":"/paper/2411.08181","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:28ed2a7382a143c99031b42253ce5e496c9797d5c0de0603b8e6f96099f35e83","observation_id":"731b916d-1c7e-4f16-b131-0beaf7289694","resolution":{"observed_at":"2026-05-17T00:31:24.691385Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08181","snapshot_observed_at":"2026-08-03T18:19:31.488462Z","title":"Challenges in Guardrailing Large Language Models for Science,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":4},"reference_index":225,"source":"pdf_text","source_observed_at":"2026-08-03T18:19:31.488462Z"},"links":{"cited_paper":"/paper/2411.08181","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:bab7e60031860d621d5fa632d041b3c130ffaadf19442b09ea02d00d1593ccad","observation_id":"b58ac6c2-ae70-4137-b7b1-6794a278d5dd","resolution":{"observed_at":"2026-08-03T18:19:31.488462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08181","snapshot_observed_at":"2026-08-02T19:13:28.853540Z","title":"Please review supplier data for supplier ID 8374928 to maintain competitive integrity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-14T11:21:38.155856Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:28.853540Z"},"links":{"cited_paper":"/paper/2411.08181","citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:83d455aca78cf83966405c7fea6eb3330856b10c58e8ec40c5991657479c2768","observation_id":"f535833d-7053-401e-89a0-25179ad8250c","resolution":{"observed_at":"2026-08-02T19:13:28.853540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.08181/citation-record","integrity":"/paper/2411.08181/integrity","json":"/paper/2411.08181/citation-record.json","paper":"/paper/2411.08181"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T21:54:43.891742Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.891742Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:cc15d2e695ea1b0de3b7acc42b45fe04411d8d372e4656cb4cba32f312a178a8","observation_id":"1f11e155-bff6-49d0-a7df-2f6590558924","resolution":{"observed_at":"2026-08-12T21:54:43.891742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.897349Z","title":"Improving language understanding by gener ative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.897349Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5450f30008928ed55bf167ad175dab431656cf32f37f94236cb078db55965cc3","observation_id":"e1854571-4e60-4983-8c20-60e7cb1e3a41","resolution":{"observed_at":"2026-08-12T21:54:43.897349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-14T06:11:14.515796Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-12T21:54:43.902444Z","title":"Finetuned language models are zero -shot learners,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.902444Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:03ec9b19e6500b980552121d43166b0bac2fd069dfd73a6581573be98418a8cf","observation_id":"bc7905e3-aaa7-4dbc-8cdf-11d5e51c3cb8","resolution":{"observed_at":"2026-08-12T21:54:43.902444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.907965Z","title":"On the dangers of stochastic parrots: Can language mod els be too big?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.907965Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:f955f8fdf64f6023bb104df9efb5d988f2080983ab7a05d1890bf45989f59e48","observation_id":"5d2eb26a-65b9-41c4-b733-92c83be17e51","resolution":{"observed_at":"2026-08-12T21:54:43.907965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.913233Z","title":"Bot-adversarial dialogue for safe conversational agents ,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.913233Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:bed11d752aa87f93db05d12ddecd1968b412753f2ffe93b37a9cdd8dc4495b1c","observation_id":"5336d59c-e9bc-4731-b47e-2a910a254fca","resolution":{"observed_at":"2026-08-12T21:54:43.913233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-12T23:51:10.026999Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-12T21:54:43.918501Z","title":"Safeguarding la rge language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.918501Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:f597dd5ad667176ed4e806bfdb51e4eb095843c6d66c734784bcdb56ef653b03","observation_id":"cb7f38ab-7832-4f35-845e-3c7167ec926e","resolution":{"observed_at":"2026-08-12T21:54:43.918501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.924865Z","title":"The social impact of natural lan guage processing,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.924865Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:ddd3bb33c009c086d47b57fc59cd40343dceae48b05264b983a49a0b64e15a72","observation_id":"cdf085b0-5d70-4207-959a-5bca7b59490b","resolution":{"observed_at":"2026-08-12T21:54:43.924865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.930313Z","title":"Dissecting racial bias in an algorithm used to manage the he alth of populations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.930313Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:8fff8052f133aa1a42722980bbc950008e0aa8b49b152b69ff8562cdbca1392c","observation_id":"8ed527af-bf41-43c8-ae3b-f5cea19f3cf3","resolution":{"observed_at":"2026-08-12T21:54:43.930313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.935711Z","title":"Chatgpt is fun, but not an author,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.935711Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:32f251e664d040896df064e0a5488f3340ec7cf926df9082b838eff636250a45","observation_id":"2c7b02a2-5467-412d-bc0e-9b2327172cd2","resolution":{"observed_at":"2026-08-12T21:54:43.935711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T21:54:43.941186Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.941186Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:1c633cd786ef4de4880fbeccc12fe7962e22902e0e24ff297276a556470b7db9","observation_id":"90b14c26-d1cd-4e2d-ba17-471b363a70a6","resolution":{"observed_at":"2026-08-12T21:54:43.941186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T21:54:43.946390Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.946390Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7c6a257aa892352f4ba5d88d4a3c27640a511ea3750d7ed98a690d19eb6ea8b9","observation_id":"623fc873-5a78-4e59-bf93-8fd76f8d53a5","resolution":{"observed_at":"2026-08-12T21:54:43.946390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.952165Z","title":"Introducing claude 3.5 sonnet,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.952165Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5c27cab8a43ec7412ec210027a044ef07bbadade12a3239ea814cb2e472d048b","observation_id":"d093290c-b989-4e07-9bae-3c2cdba8326a","resolution":{"observed_at":"2026-08-12T21:54:43.952165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-12T21:54:43.957264Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.957264Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:cc8b19da9c1dd18609322d8426bda41d704690dd321630a48db372377172b18e","observation_id":"981ed5d0-4011-4d10-9ba3-02de9c1ca65c","resolution":{"observed_at":"2026-08-12T21:54:43.957264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T21:54:43.962576Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.962576Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:2bb652040594f8e86aee7635278aa2fd82e0589f3c51f2d79f67f1a7c4f75c8f","observation_id":"19b4fe03-8f4c-4bef-a36a-5d2dc8bc797a","resolution":{"observed_at":"2026-08-12T21:54:43.962576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-12T21:54:43.968092Z","title":"On the opportunities and risks of foundation models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.968092Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:a4f442646c463928bd0bb441823112c0a71647a6366c7d6671af138e59381441","observation_id":"e27e247e-6df7-4500-8876-10ae40c3fbde","resolution":{"observed_at":"2026-08-12T21:54:43.968092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07361","last_updated":"2023-12-08T06:30:12Z","snapshot_observed_at":"2026-08-13T05:27:03.483201Z","submitted_at":"2023-11-13T14:26:12Z","title":"The Impact of Large Language Models on Scientific Discovery: a Preliminary Study using GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07361","snapshot_observed_at":"2026-08-12T21:54:43.973162Z","title":"The impact of large l anguage models on scientiﬁc discovery: a preliminary study using gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.973162Z"},"links":{"cited_paper":"/paper/2311.07361","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:27294bf48b65a9d0f4b39827a118979ca0a2d849f9e7758b387e352f29298e81","observation_id":"f700533d-4fab-49c2-b9ce-722be1e99013","resolution":{"observed_at":"2026-08-12T21:54:43.973162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04929","last_updated":"2023-11-03T19:41:09Z","snapshot_observed_at":"2026-08-14T03:20:47.939574Z","submitted_at":"2023-11-03T19:41:09Z","title":"An Interdisciplinary Outlook on Large Language Models for Scientific Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04929","snapshot_observed_at":"2026-08-12T21:54:43.978039Z","title":"An interdisciplinary outlook on large language models for sci entiﬁc research,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.978039Z"},"links":{"cited_paper":"/paper/2311.04929","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:39a25cc21044c35fbbe0b0e8224058e7c032958f0526d4c39aa68edc17781d04","observation_id":"8a33905f-fd9f-4800-b244-64eefe8f816a","resolution":{"observed_at":"2026-08-12T21:54:43.978039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:43.982826Z","title":"The ethics of chatg pt in medicine and healthcare: a systematic review on large l anguage models (llms),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.982826Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:3c5c05e2ce5d1013536589eeffd541f2b188783c328ab8cfc9256e1f3aa34d41","observation_id":"8e2f1124-12f7-4259-bcc5-6bc8e2d91eee","resolution":{"observed_at":"2026-08-12T21:54:43.982826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02678","last_updated":"2023-08-01T07:21:25Z","snapshot_observed_at":"2026-08-13T10:43:27.893082Z","submitted_at":"2023-08-01T07:21:25Z","title":"Ethical Considerations and Policy Implications for Large Language Models: Guiding Responsible Development and Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02678","snapshot_observed_at":"2026-08-12T21:54:43.987633Z","title":"Ethic al considerations and policy implications for large langua ge models: Guiding responsible development and deployment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.987633Z"},"links":{"cited_paper":"/paper/2308.02678","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:879dc1c9e5f5b62ef05f38fae5fd90dbed847fa22786edfac13faa1105889cbb","observation_id":"8b7e8b1a-c1da-4308-800c-91ab4272ef8a","resolution":{"observed_at":"2026-08-12T21:54:43.987633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-12T21:54:43.992834Z","title":"Ll ama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.992834Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:4ee3f72cdf598f6c771d502ff135879365af4b06f9da998f5611432aa3ed0e08","observation_id":"8a6bd30b-cd2c-4afa-9444-b7007f20520b","resolution":{"observed_at":"2026-08-12T21:54:43.992834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10501","last_updated":"2023-10-16T15:20:30Z","snapshot_observed_at":"2026-08-13T22:48:44.761206Z","submitted_at":"2023-10-16T15:20:30Z","title":"NeMo Guardrails: A Toolkit for Controllable and Safe LLM Applications with Programmable Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10501","snapshot_observed_at":"2026-08-12T21:54:43.998281Z","title":"Nemo guardrails: A toolkit for controllable and safe ll m applications with programmable rails,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.998281Z"},"links":{"cited_paper":"/paper/2310.10501","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:96aac62ac99d9e066c3cc003dc76587427a4208d27bec73c092904460c8d4f89","observation_id":"b2252999-c98c-4cff-a5d1-dca18bd0d6a4","resolution":{"observed_at":"2026-08-12T21:54:43.998281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.003248Z","title":"Prompti ng is programming: A query language for large language model s,","venue":null,"work_id":null,"year":1946},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.003248Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:0c92e10ea99f450ac5e607aaf6b9350ea37c7f7b8539773933b7c524ae634148","observation_id":"6eae1cb2-ff42-444e-b3ef-e97ca51068cf","resolution":{"observed_at":"2026-08-12T21:54:44.003248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.009022Z","title":"Guidance: A language f or controlling large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.009022Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:8658e39a8c24661ee857c2185719136ac119664e4d9c65294e7c276eecf5fd49","observation_id":"91e6a922-6d43-46aa-a96b-d0218487ab35","resolution":{"observed_at":"2026-08-12T21:54:44.009022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.014654Z","title":"Guardrails: Adding guard rails to large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.014654Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:abcd7807013f1e3286eb83eeb1a60718197154aeae7bf334595b4bf7ea36f9d4","observation_id":"2777e52a-469d-4fd0-8f0f-783ada811f22","resolution":{"observed_at":"2026-08-12T21:54:44.014654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.021017Z","title":"Ai-generate d clinical summaries require more than accuracy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.021017Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7a12be6ea848f2423cb9586095a7a549be6a140258520a977bbfb48f7dc3863a","observation_id":"081a395c-d870-4a35-9486-fcf1779860fc","resolution":{"observed_at":"2026-08-12T21:54:44.021017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-12T21:54:44.027139Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questi ons,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.027139Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:111d8a39559f43f65c0da5a9ce3dce34d8e1be5722cad869b2c153bcc4746084","observation_id":"de3e4871-7e6d-4709-b562-c87d4d771b69","resolution":{"observed_at":"2026-08-12T21:54:44.027139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-15T10:00:18.885121Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-12T21:54:44.032244Z","title":"Building guardrails for large language mod els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.032244Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e59bf982d468029c0e2eda3bbd83b7032d2046baacff4a710f6132e0d0c7f1bb","observation_id":"f0513262-d87a-4f9b-8918-e4b95bd43a03","resolution":{"observed_at":"2026-08-12T21:54:44.032244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18344","last_updated":"2023-10-22T14:45:14Z","snapshot_observed_at":"2026-08-15T11:40:42.357192Z","submitted_at":"2023-10-22T14:45:14Z","title":"Chainpoll: A high efficacy method for LLM hallucination detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18344","snapshot_observed_at":"2026-08-12T21:54:44.037719Z","title":"Chainpoll: A high efﬁcacy metho d for llm hallucination detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.037719Z"},"links":{"cited_paper":"/paper/2310.18344","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:2d588699b8b34e96388d2dec0aa5807e3a28d8fe86b39882f0838c9672d9261f","observation_id":"6495ba8b-eac3-41c9-9f2c-e8f444fae62a","resolution":{"observed_at":"2026-08-12T21:54:44.037719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-12T21:54:44.043259Z","title":"Selfcheckgpt: Z ero-resource black-box hallucination detection for gener ative large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.043259Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:14d26947287d927bf6af5cd7fdc5deeadf39cf60692e3810b9946795bfbe9166","observation_id":"327efb7a-898d-44f3-9123-1f8b00c2408f","resolution":{"observed_at":"2026-08-12T21:54:44.043259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04166","last_updated":"2023-02-13T16:19:05Z","snapshot_observed_at":"2026-08-05T08:58:00.258106Z","submitted_at":"2023-02-08T16:17:29Z","title":"GPTScore: Evaluate as You Desire","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04166","snapshot_observed_at":"2026-08-12T21:54:44.048550Z","title":"Gptscore: Evaluat e as you desire,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.048550Z"},"links":{"cited_paper":"/paper/2302.04166","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:6628036f64ec667aa9b7ae33f0993560a74138a14bfa61b8b7af754c46feac33","observation_id":"7deed123-454c-4c93-a9d5-4ef03c88aacf","resolution":{"observed_at":"2026-08-12T21:54:44.048550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-12T21:54:44.053770Z","title":"G-eval: Nlg evaluation using gpt-4 with better human alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.053770Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7aec7d009bac7b55f5bda572ea5054735db32a39cd92a6743d35e8d60ab3bb78","observation_id":"36731d93-614a-4edc-8038-8ad7e2545760","resolution":{"observed_at":"2026-08-12T21:54:44.053770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.059127Z","title":"Evaluation and mitigation of the limitations of large language models in cl inical decision-making,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.059127Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:88e8b0e137241a5d2e7abdeca5a14de3f9d14fea751f7b0e20bf7fd969c9946a","observation_id":"205b22df-a6bf-42ca-936e-5314c3cf6bf6","resolution":{"observed_at":"2026-08-12T21:54:44.059127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08527","last_updated":"2022-04-03T00:08:13Z","snapshot_observed_at":"2026-08-15T20:09:19.010539Z","submitted_at":"2021-10-16T09:40:30Z","title":"An Empirical Survey of the Effectiveness of Debiasing Techniques for Pre-trained Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08527","snapshot_observed_at":"2026-08-12T21:54:44.064381Z","title":"An empirical su rvey of the effectiveness of debiasing techniques for pre-t rained language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.064381Z"},"links":{"cited_paper":"/paper/2110.08527","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:0d111a38eeedca079c1eac187e3170aee364f0583a652d4bbd59d0ef70bcee16","observation_id":"0120ee3b-f2bc-41bb-b8d2-b35ff506f87e","resolution":{"observed_at":"2026-08-12T21:54:44.064381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.070546Z","title":"Mitigating un wanted biases with adversarial learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.070546Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:10008b142e9404da79c467ca82cf350618e11f37cf2219acdf14c109f89dacb5","observation_id":"f09feebe-a1ec-4c47-9988-a30e210cc3b7","resolution":{"observed_at":"2026-08-12T21:54:44.070546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.075721Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.075721Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:f642acdd434f52807d5714315d9abae1f2debf85ace0b72b6aef861064ebcb1c","observation_id":"f8375dfb-e05d-449c-8053-0ad1558a4b33","resolution":{"observed_at":"2026-08-12T21:54:44.075721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.080727Z","title":"The secret sharer: Evalu ating and testing unintended memorization in neural networ ks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.080727Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7b07f915654372ef3ce42d8b11dc744e2c7a91fefc8626410da8b3e1a8ba2e7b","observation_id":"0a249320-0280-40f5-b364-863a5f982793","resolution":{"observed_at":"2026-08-12T21:54:44.080727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06717","last_updated":"2024-05-30T19:26:05Z","snapshot_observed_at":"2026-08-13T05:05:31.314057Z","submitted_at":"2023-12-11T01:26:53Z","title":"Privacy Issues in Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06717","snapshot_observed_at":"2026-08-12T21:54:44.085949Z","title":"Privacy issues in large language m odels: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.085949Z"},"links":{"cited_paper":"/paper/2312.06717","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:d91322f6ccb8fc773176d86e82f8ff42573debae380fb3b4df5cb81e1f8902a1","observation_id":"50da8ea9-8d16-4d09-8f8c-f1f2a666b6c1","resolution":{"observed_at":"2026-08-12T21:54:44.085949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.091321Z","title":"Beyo nd memorization: Violating privacy via inference with larg e language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.091321Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:ceb59034a72c995d4a50400c1cff8c7b3e3104e8819a2d0f949a3c8cbfbcdfab","observation_id":"ef7e6a3f-b883-4c26-a196-a6e72ef70aa1","resolution":{"observed_at":"2026-08-12T21:54:44.091321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.095935Z","title":"Pro pile: Probing privacy leakage in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.095935Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:4455a735cd61d6f75ca0065e4b097636dfe72bdf2536c0ed75b23864b140cf42","observation_id":"ea402277-1df4-47c4-b65d-9fa556d0fa5f","resolution":{"observed_at":"2026-08-12T21:54:44.095935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15641","last_updated":"2024-10-21T05:01:50Z","snapshot_observed_at":"2026-08-12T22:18:58.790631Z","submitted_at":"2024-10-21T05:01:50Z","title":"SMILES-Prompting: A Novel Approach to LLM Jailbreak Attacks in Chemical Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15641","snapshot_observed_at":"2026-08-12T21:54:44.101108Z","title":"Smiles-prompting: A n ovel approach to llm jailbreak attacks in chemical synthesi s,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.101108Z"},"links":{"cited_paper":"/paper/2410.15641","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:143461372362a537dbc34b8dbb698669bafd91c98ac275172d5c947fef8f0d84","observation_id":"49719e6e-0c60-4433-8179-6bcb896c9b5c","resolution":{"observed_at":"2026-08-12T21:54:44.101108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14656","last_updated":"2024-07-23T13:56:42Z","snapshot_observed_at":"2026-08-13T04:34:18.772084Z","submitted_at":"2024-01-26T05:33:34Z","title":"Scientific Large Language Models: A Survey on Biological & Chemical Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14656","snapshot_observed_at":"2026-08-12T21:54:44.105961Z","title":"Scientiﬁc large language models: A survey on bio logical & chemical domains,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.105961Z"},"links":{"cited_paper":"/paper/2401.14656","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:102eb8e598d10173ddbd57f853754428a5ca8100e4215df261d894b931f8ff26","observation_id":"ca58ea15-dd3c-4a62-94a9-0b055c3653ee","resolution":{"observed_at":"2026-08-12T21:54:44.105961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-12T21:54:44.110699Z","title":"Baseline defenses for adversarial attacks against aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.110699Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:8e54e69248bc01b7a4859933109d5da306821c2957a2a7f68c1d2ff4485564a1","observation_id":"84011c70-a71c-4936-93d9-20f553aa716a","resolution":{"observed_at":"2026-08-12T21:54:44.110699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-08-15T19:46:54.909325Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-12T21:54:44.115744Z","title":"Red teaming languag e models with language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.115744Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:564800f6667b361c1fdfd5ba6de53e21953aedd8510d9bf22118afa873ec5a34","observation_id":"dcb77c67-c192-4969-930b-e1afc6765e19","resolution":{"observed_at":"2026-08-12T21:54:44.115744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12095","last_updated":"2023-08-29T05:34:25Z","snapshot_observed_at":"2026-08-13T18:22:43.516950Z","submitted_at":"2023-02-22T11:01:20Z","title":"On the Robustness of ChatGPT: An Adversarial and Out-of-distribution Perspective","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12095","snapshot_observed_at":"2026-08-12T21:54:44.120556Z","title":"On the robustness of chatgpt: An adversarial and out-of-distribution perspective,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.120556Z"},"links":{"cited_paper":"/paper/2302.12095","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:900096c4ad7cdc6e9d668f04386598dbd3f632edc36ea7161238f1a649958f7c","observation_id":"0c1565ab-bf5c-4e89-a85a-26ec19855dcd","resolution":{"observed_at":"2026-08-12T21:54:44.120556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.126008Z","title":"Red teaming large language models in medicine: Real-world insights on m odel behavior,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.126008Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:f73d46793252bbc8520e5c7d2a5c6bd7fbe8f79a3172164055bcffb1d1c8cc90","observation_id":"a46a3055-390c-4224-842a-5fb4b71f9956","resolution":{"observed_at":"2026-08-12T21:54:44.126008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.131003Z","title":"Right to be forgotten in the era of l arge language models: Implications, challenges, and solutions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.131003Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e92d8ccac054fa5a66e6d7acd73ee7a4466c3c2f06217afd0bc1307bd2576260","observation_id":"2edd5979-7ab3-48cd-8d4e-c905740f135a","resolution":{"observed_at":"2026-08-12T21:54:44.131003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-09T05:10:26.091710Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-12T21:54:44.135810Z","title":"Realtoxicityprompts: Evaluating neural toxic degenera tion in language models,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.135810Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:ed4da006c75f7789daeb5abc2acdb153de9663ab652e10740b33e2f07b59a5c2","observation_id":"8ae6a772-b49c-4f58-97e3-43f1fefb1b14","resolution":{"observed_at":"2026-08-12T21:54:44.135810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-12T21:54:44.141244Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.141244Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5e1b71a7e634144ddd41a455591f350e77b50d40c26e3f0646e58adc1a76edf8","observation_id":"11d4a3d0-1e99-4f23-96b5-1fcef8acc2eb","resolution":{"observed_at":"2026-08-12T21:54:44.141244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.146706Z","title":"Ai transparency in the age of llm s: A human-centered research roadmap,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.146706Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:30fd872fcf88f7bb00dbbf907a3eb555b1061caae6c9a5def234ff715f363428","observation_id":"1aa41a0c-1efc-4edb-9471-828b5e772b02","resolution":{"observed_at":"2026-08-12T21:54:44.146706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13240","last_updated":"2023-11-22T08:57:55Z","snapshot_observed_at":"2026-08-15T18:09:47.654321Z","submitted_at":"2023-11-22T08:57:55Z","title":"On the Calibration of Large Language Models and Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13240","snapshot_observed_at":"2026-08-12T21:54:44.151209Z","title":"On the calibr ation of large language models and alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.151209Z"},"links":{"cited_paper":"/paper/2311.13240","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e0c226a53b1234f38a2f80fee15ca815454f7bc287738cda5f6a45d488e47afa","observation_id":"a87bfae7-020c-44ed-b776-53c292a5ce15","resolution":{"observed_at":"2026-08-12T21:54:44.151209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00826","last_updated":"2022-06-02T01:54:58Z","snapshot_observed_at":"2026-08-15T11:59:25.910015Z","submitted_at":"2022-06-02T01:54:58Z","title":"BayesFormer: Transformer with Uncertainty Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.00826","snapshot_observed_at":"2026-08-12T21:54:44.156970Z","title":"Bayesformer: Transformer with uncertainty estimation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.156970Z"},"links":{"cited_paper":"/paper/2206.00826","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:b2611efd841d8dd7e2079f5f217704fafb3b03b8afbadf22e2ecfa1863a2d87f","observation_id":"1e6162cc-db44-4488-9419-1945a374eb15","resolution":{"observed_at":"2026-08-12T21:54:44.156970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.162272Z","title":"Large language models, scientiﬁc knowledge and factua lity: A framework to streamline human expert evaluation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.162272Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:3c40d9d59629dd5c9c7c2877affa3806680fc189919c13bb3e63f6b5f46e23a6","observation_id":"660ef3d2-c520-415d-b0c0-c0b3bcf854e8","resolution":{"observed_at":"2026-08-12T21:54:44.162272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04481","last_updated":"2024-09-06T02:03:38Z","snapshot_observed_at":"2026-08-12T22:50:17.181211Z","submitted_at":"2024-09-06T02:03:38Z","title":"Large Language Models in Drug Discovery and Development: From Disease Mechanisms to Clinical Trials","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04481","snapshot_observed_at":"2026-08-12T21:54:44.167106Z","title":"Large language models in drug discovery and development: From disease mechanisms to clinical trials,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.167106Z"},"links":{"cited_paper":"/paper/2409.04481","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:3372c4ed0506af1d390b65b1bcfd9dc60b865073bb2f31105c21f9a32a38d084","observation_id":"26c8900b-1bc8-412f-b0e1-71e0c7b4936e","resolution":{"observed_at":"2026-08-12T21:54:44.167106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02932","last_updated":"2024-05-28T15:36:49Z","snapshot_observed_at":"2026-08-13T05:57:29.158087Z","submitted_at":"2023-10-04T16:09:48Z","title":"Assessing Large Language Models on Climate Information","version":2},"cited_work":{"arxiv_id":"2310.02932","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.02932","snapshot_observed_at":"2026-08-12T21:54:45.125062Z","title":"Assessing Large Language Models on Climate Information","venue":"cs.CL","work_id":"1b033122-95e0-48cc-aeb0-52f70ff57e2e","year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.172677Z"},"links":{"cited_paper":"/paper/2310.02932","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:1330988a79ee3a518b136d1e0af51bdb7dba63a851df07c3bae769615a917990","observation_id":"35c43ed2-6463-4137-a1ae-43aba4e055da","resolution":{"observed_at":"2026-08-12T21:54:45.131022Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.178106Z","title":"Unlearning climate misinformation in la rge language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.178106Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:85a3da4c02f924fc79e478e75212cbd031412e6fe58b648ce6f2262d9239c032","observation_id":"c838e7de-f397-46cb-8602-ac056d5740da","resolution":{"observed_at":"2026-08-12T21:54:44.178106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00116","last_updated":"2023-03-31T20:24:14Z","snapshot_observed_at":"2026-08-15T07:33:07.563124Z","submitted_at":"2023-03-31T20:24:14Z","title":"Enhancing Large Language Models with Climate Resources","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00116","snapshot_observed_at":"2026-08-12T21:54:44.183664Z","title":"Enha ncing large language models with climate resources,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.183664Z"},"links":{"cited_paper":"/paper/2304.00116","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:6364c204a105844d062ee1cdddd4f236346e6710b54f2d2feeedb67bf263ecd5","observation_id":"b139aaac-4090-497b-8647-73fc4aba9aa9","resolution":{"observed_at":"2026-08-12T21:54:44.183664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.189009Z","title":"Better patching using llm prom pting, via self-consistency,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.189009Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7ee8ad754957f7d53681f42ff67c5cbc929c25ad9772f77bbf181b709925c380","observation_id":"fb7d8202-15a2-49fd-a3c2-29801bc999af","resolution":{"observed_at":"2026-08-12T21:54:44.189009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.193811Z","title":"Chain-of-thought prompting elicits reasoning in large l anguage models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.193811Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:b0df25aa5919107b5b4eec7afac6046a830a92867ec68ebedb7570f499efe4d1","observation_id":"bd3881d4-1d6b-4b40-99c8-f42ca03f7eb8","resolution":{"observed_at":"2026-08-12T21:54:44.193811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.199382Z","title":"How can we kno w when language models know? on the calibration of language m odels for question answering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.199382Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:9ede44852c60e25be054721d7bd020bb82ef35478cb2410cf07bb057a82e7fe9","observation_id":"36e2bc35-f678-4881-bd9f-7c46f1349402","resolution":{"observed_at":"2026-08-12T21:54:44.199382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.204425Z","title":"”why should I t rust you?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.204425Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:0a76bc7d62b788ce1154a5aad79207b84cd70684a29b5bbb4ef46cc6bd147ed4","observation_id":"4dcda704-2c1b-477f-9da3-f39597fa6bde","resolution":{"observed_at":"2026-08-12T21:54:44.204425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.209234Z","title":"A uniﬁed approach to inter preting model predictions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.209234Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:fd5144426e728bb0e71a497c6d9034e450e1f2b14596e6fcc5fd3c91df24ae6a","observation_id":"7a8af831-7eb5-47e5-8ca8-6b9c7bb46b0a","resolution":{"observed_at":"2026-08-12T21:54:44.209234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.214036Z","title":"Actionable auditing: Inv estigating the impact of publicly naming biased performanc e results of commercial ai products,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.214036Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5c34724980aece905df560550570281d31c6e637aeb64a3d364291037da9165e","observation_id":"8449355f-3964-46df-938e-122e5c7f375c","resolution":{"observed_at":"2026-08-12T21:54:44.214036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15848","last_updated":"2024-08-18T05:05:19Z","snapshot_observed_at":"2026-08-13T05:42:09.928098Z","submitted_at":"2023-10-24T14:01:53Z","title":"On Responsible Machine Learning Datasets with Fairness, Privacy, and Regulatory Norms","version":4},"cited_work":{"arxiv_id":"2310.15848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.15848","snapshot_observed_at":"2026-08-12T21:54:45.083126Z","title":"On Responsible Machine Learning Datasets with Fairness, Privacy, and Regulatory Norms","venue":"cs.LG","work_id":"115a8b07-8da1-4439-9df0-73c74a4c9c6e","year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.218901Z"},"links":{"cited_paper":"/paper/2310.15848","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:cfdda4a1718b1175494e5c72e5c647ba97d5d94c01ec8869304be1850f7951cf","observation_id":"9b3a0121-6c4e-42d0-94dc-59f2ee15a711","resolution":{"observed_at":"2026-08-12T21:54:45.089006Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.224158Z","title":"Privacy a nd fairness in federated learning: on the perspective of tra deoff,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.224158Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:38f5b0b733fba322638feff12b47c4be122e807f4584157e5aa9d58306371b80","observation_id":"db5e5ecb-1335-4387-bfa5-91483ca0d21a","resolution":{"observed_at":"2026-08-12T21:54:44.224158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.228887Z","title":"Low-cost high-po wer membership inference attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.228887Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:628a77077bfb296024aa5298e0d2f592aa0eb685cc548832620519973ffef14a","observation_id":"af9abb80-50ab-47b6-983e-0ce4d39326fd","resolution":{"observed_at":"2026-08-12T21:54:44.228887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04451","last_updated":"2024-09-23T13:57:56Z","snapshot_observed_at":"2026-08-15T06:04:08.401856Z","submitted_at":"2024-03-07T12:43:42Z","title":"Membership Inference Attacks and Privacy in Topic Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04451","snapshot_observed_at":"2026-08-12T21:54:44.233479Z","title":"Membership inf erence attacks and privacy in topic modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.233479Z"},"links":{"cited_paper":"/paper/2403.04451","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:fea36a886522124a8ed5a2a5bdfcdab6c5077a9f38444652d2c035697649aa1b","observation_id":"6c8828b9-f312-4645-abce-908d7767f050","resolution":{"observed_at":"2026-08-12T21:54:44.233479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01380","last_updated":"2024-09-02T17:23:23Z","snapshot_observed_at":"2026-08-15T06:40:00.607539Z","submitted_at":"2024-09-02T17:23:23Z","title":"Membership Inference Attacks Against In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01380","snapshot_observed_at":"2026-08-12T21:54:44.238052Z","title":"Membership infer ence attacks against in-context learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.238052Z"},"links":{"cited_paper":"/paper/2409.01380","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e5845cc516230386f44dfab685717213c425ce2e27ed24b1f6bc3c6776dc77df","observation_id":"0e9979c9-91a4-4064-84e0-032999b44d4f","resolution":{"observed_at":"2026-08-12T21:54:44.238052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04247","last_updated":"2025-07-21T18:59:21Z","snapshot_observed_at":"2026-08-13T04:24:54.142218Z","submitted_at":"2024-02-06T18:54:07Z","title":"Risks of AI Scientists: Prioritizing Safeguarding Over Autonomy","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04247","snapshot_observed_at":"2026-08-12T21:54:44.242850Z","title":"Pr ioritizing safeguarding over autonomy: Risks of llm agents for science,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.242850Z"},"links":{"cited_paper":"/paper/2402.04247","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:0850cb65ef42345aa8dc15a2c5d871ab866116076b10c07bfe4883766f797e8c","observation_id":"2b0c6d8d-559d-4b45-8762-b094ed29ede9","resolution":{"observed_at":"2026-08-12T21:54:44.242850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10964","last_updated":"2020-05-05T22:00:44Z","snapshot_observed_at":"2026-08-15T10:24:27.581301Z","submitted_at":"2020-04-23T04:21:19Z","title":"Don't Stop Pretraining: Adapt Language Models to Domains and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10964","snapshot_observed_at":"2026-08-12T21:54:44.247929Z","title":"Don’t stop pretraining : Adapt language models to domains and tasks,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.247929Z"},"links":{"cited_paper":"/paper/2004.10964","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:976177a2ce7d42fb64e4df59c6c39c43e57363bce653b36358804a1af47c12b8","observation_id":"46a20be8-c917-4f03-945f-1fd40333eb6b","resolution":{"observed_at":"2026-08-12T21:54:44.247929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10446","last_updated":"2024-03-15T16:30:14Z","snapshot_observed_at":"2026-08-14T12:37:51.344845Z","submitted_at":"2024-03-15T16:30:14Z","title":"Enhancing LLM Factual Accuracy with RAG to Counter Hallucinations: A Case Study on Domain-Specific Queries in Private Knowledge-Bases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10446","snapshot_observed_at":"2026-08-12T21:54:44.252895Z","title":"Enhancing llm factual accu racy with rag to counter hallucinations: A case study on doma in-speciﬁc queries in private knowledge-bases,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.252895Z"},"links":{"cited_paper":"/paper/2403.10446","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:70cdabb7c5317adbdd5acdc9f8031895229a01da0a438ab7e524b09251afec42","observation_id":"0476ac76-df6c-40d2-8dbb-f1c9a6db9c4e","resolution":{"observed_at":"2026-08-12T21:54:44.252895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01041","last_updated":"2024-09-20T06:29:05Z","snapshot_observed_at":"2026-08-13T05:34:26.456061Z","submitted_at":"2023-11-02T07:20:49Z","title":"Learn to Refuse: Making Large Language Models More Controllable and Reliable through Knowledge Scope Limitation and Refusal Mechanism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01041","snapshot_observed_at":"2026-08-12T21:54:44.257959Z","title":"Learn to refuse: Making large language models m ore controllable and reliable through knowledge scope limi tation and refusal mechanism,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.257959Z"},"links":{"cited_paper":"/paper/2311.01041","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:622d651388d61c8a180d807f005c55e4d6468b9c39a32054d3f11aeb90a724a6","observation_id":"f4fac9a4-b12e-499a-ba49-1ecf11fb6a70","resolution":{"observed_at":"2026-08-12T21:54:44.257959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01313","last_updated":"2024-01-08T16:19:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T17:56:30Z","title":"A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01313","snapshot_observed_at":"2026-08-12T21:54:44.263253Z","title":"A comprehensive survey of hallucin ation mitigation techniques in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.263253Z"},"links":{"cited_paper":"/paper/2401.01313","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:c91b0617062b09d56a858d649bb0058e17f029bf052c36abc3c56a37c2af235b","observation_id":"e28d23d5-a4c3-426e-9296-15cd84210a90","resolution":{"observed_at":"2026-08-12T21:54:44.263253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06632","last_updated":"2023-12-11T18:50:57Z","snapshot_observed_at":"2026-08-15T16:49:35.678993Z","submitted_at":"2023-12-11T18:50:57Z","title":"Control Risk for Potential Misuse of Artificial Intelligence in Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06632","snapshot_observed_at":"2026-08-12T21:54:44.268204Z","title":"Control ris k for potential misuse of artiﬁcial intelligence in science,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.268204Z"},"links":{"cited_paper":"/paper/2312.06632","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:779f7b44306ffe219c5a7cc8c1ecdd96743ee25daa971f10d7d2a73384913c45","observation_id":"4b9aca17-4c5f-4d3f-ba5d-e866fad2e674","resolution":{"observed_at":"2026-08-12T21:54:44.268204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.273049Z","title":"Compliance d isengagement in research: Development and validation of a n ew measure,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.273049Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:b4699be8edb7151b2c874d06e3f1492edd01bdb36c7e335bf9d33c938f8496f2","observation_id":"d8e178c1-243d-4464-8fd9-184b99151ad0","resolution":{"observed_at":"2026-08-12T21:54:44.273049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.277931Z","title":"Guidance for researchers and peer-review ers on the ethical use of large language models (llms) in scie ntiﬁc research workﬂows,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.277931Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e21511ceaeea553d17ead841148e4836282f3587983d280ac82ff8ff109be300","observation_id":"fe9efd60-4edd-48da-a190-1d2235eeac65","resolution":{"observed_at":"2026-08-12T21:54:44.277931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.282770Z","title":"The ethics of using artiﬁc ial intelligence in scientiﬁc research: new guidance neede d for a new tool,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.282770Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5e612dd4fd438faf1a1aaca9ba92b6356fd19bc25f83b7cf51cc764c63debc04","observation_id":"a8bfa1cd-4f31-4fd8-b97b-a8c1062a95da","resolution":{"observed_at":"2026-08-12T21:54:44.282770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.287759Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.287759Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7002c82add8d6439d73728fbff856eb2d4eea1a861bcd4c2b280ebc61820587e","observation_id":"97c212e7-0600-410d-8e91-b5e60f0a06b0","resolution":{"observed_at":"2026-08-12T21:54:44.287759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.292412Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.292412Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7f843726e9276c34ecd131ce8959b7b50b3b64430c5cf0debfa068610fc279c5","observation_id":"d708ef06-1e2a-45d8-84b5-0eed8cd47251","resolution":{"observed_at":"2026-08-12T21:54:44.292412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.297212Z","title":"Citation: A key to building respo nsible and accountable large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.297212Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:84495615f12c4fd14f838d5d1435be7514c4b17973bb4852ce1d0cee461e1c06","observation_id":"cf31892e-ad10-4e08-9696-dfdf98b1d244","resolution":{"observed_at":"2026-08-12T21:54:44.297212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08700","last_updated":"2024-10-02T07:26:40Z","snapshot_observed_at":"2026-08-14T13:25:45.645023Z","submitted_at":"2024-04-10T18:08:59Z","title":"DyKnow: Dynamically Verifying Time-Sensitive Factual Knowledge in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08700","snapshot_observed_at":"2026-08-12T21:54:44.302060Z","title":"Dyknow:dyn amically verifying time-sensitive factual knowledge in ll ms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.302060Z"},"links":{"cited_paper":"/paper/2404.08700","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:cfdfc8de99282948821464f1efe9438c2853df27d1b8722d8737fd97a10a7106","observation_id":"934e8c4b-c2f3-4623-8984-68a6ffaed360","resolution":{"observed_at":"2026-08-12T21:54:44.302060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13598","last_updated":"2024-09-09T19:51:57Z","snapshot_observed_at":"2026-08-15T08:00:48.617187Z","submitted_at":"2024-02-21T08:03:27Z","title":"User-LLM: Efficient LLM Contextualization with User Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13598","snapshot_observed_at":"2026-08-12T21:54:44.306981Z","title":"User-llm: Efﬁcient llm cont extualization with user embeddings,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.306981Z"},"links":{"cited_paper":"/paper/2402.13598","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:1961b0fd941931f7aa1af62341db20f6dbc7f6d6feff7904d90289306d8a1dd2","observation_id":"a6951630-52e7-4216-9bf8-9d2766ee1527","resolution":{"observed_at":"2026-08-12T21:54:44.306981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.312242Z","title":"A novel nih rese arch grant recommender using bert,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.312242Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:1a93b75f5916ea50e1272f6af2b88dbcbd1321703e043d21c6ed6b610b8d853c","observation_id":"4853d6e2-d0a4-46ab-853a-a286ba8b07f5","resolution":{"observed_at":"2026-08-12T21:54:44.312242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11280-024-01291-2/fulltext","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.594472Z","title":"A survey on large lan guage models for recommendation,","venue":null,"work_id":"0e423d04-5726-49d5-b18c-86cc1a2796d9","year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.317187Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:3a90b22259b31050768b5c772a72bdc470b6e54c0c67beabf7b61465a302ddb0","observation_id":"2037b7aa-5581-41c5-8258-bca9a7be5418","resolution":{"observed_at":"2026-08-12T21:54:44.602237Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.322218Z","title":"A uniﬁed framework of ﬁve princ iples for ai in society,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.322218Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:4d233cc4c621006f0531ff6359c3f27443382fd4e1c832b5bd63158d3eb10909","observation_id":"f1239faf-802b-496b-9716-1b9f2725f59d","resolution":{"observed_at":"2026-08-12T21:54:44.322218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08726","last_updated":"2023-05-31T17:55:02Z","snapshot_observed_at":"2026-08-13T14:04:03.647450Z","submitted_at":"2022-10-17T03:44:30Z","title":"RARR: Researching and Revising What Language Models Say, Using Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.08726","snapshot_observed_at":"2026-08-12T21:54:44.327647Z","title":"Rarr: Researching and revising what language models say, using language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.327647Z"},"links":{"cited_paper":"/paper/2210.08726","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:2f1be461d9f4d52e42eb4561d3709b2a87198bd62e9a158ef96852d280392d29","observation_id":"e6144632-da99-4bce-b166-681d4f237c6e","resolution":{"observed_at":"2026-08-12T21:54:44.327647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08037","last_updated":"2023-02-10T20:04:05Z","snapshot_observed_at":"2026-08-13T13:20:36.379988Z","submitted_at":"2022-12-15T18:45:29Z","title":"Attributed Question Answering: Evaluation and Modeling for Attributed Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08037","snapshot_observed_at":"2026-08-12T21:54:44.333243Z","title":"Attributed question answering: Evaluation and modeling for attributed large la nguage models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.333243Z"},"links":{"cited_paper":"/paper/2212.08037","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:b8a2f0e6950667e53105a87614458b54714b8a663f4fc78f799a14484c05a743","observation_id":"5d6c0e0d-7cf5-413a-bfc6-36f5d5a97e84","resolution":{"observed_at":"2026-08-12T21:54:44.333243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08460","last_updated":"2025-04-02T07:20:24Z","snapshot_observed_at":"2026-08-14T02:34:25.381436Z","submitted_at":"2024-05-14T09:31:31Z","title":"Is Your LLM Outdated? A Deep Look at Temporal Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08460","snapshot_observed_at":"2026-08-12T21:54:44.338511Z","title":"Is your llm outdated? evaluating llms at temporal generaliz ation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.338511Z"},"links":{"cited_paper":"/paper/2405.08460","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e94ed8ac509d32068a8932804125d1fffa5c3c859736765acf1839737d29176e","observation_id":"618ee352-c58c-4f1f-bae5-8fa460affc10","resolution":{"observed_at":"2026-08-12T21:54:44.338511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.343899Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.343899Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7e848c989651ad9248947b963c4fb6854030eae792b907ef9d93990088894407","observation_id":"daa6b55f-64b2-4e32-9217-74f5c91e0592","resolution":{"observed_at":"2026-08-12T21:54:44.343899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.348718Z","title":"Updating knowledge in large language models: an empirica l evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.348718Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:f45f05ed10644f823fc14dc4b5d62d269a1ee53083c84517fcfb4ea436eb4910","observation_id":"67fa54a7-2878-4673-bf49-6424b8579dd2","resolution":{"observed_at":"2026-08-12T21:54:44.348718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.353468Z","title":"Disinformation capabilities of large lang uage models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.353468Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5a2d591df7389a189425535a11af2312a477329f070f73f235a563d71cc3220b","observation_id":"81e95c2b-5de1-4352-8cae-3177a0eb8397","resolution":{"observed_at":"2026-08-12T21:54:44.353468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.358390Z","title":"Chameleon: Plug-and-play compositi onal reasoning with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.358390Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:92a697950f07183e19d2a1fd3bd063193c73982a88e07dd479e95d251d02c33d","observation_id":"99d6f4fe-caa0-488b-a420-1ffc537a49ef","resolution":{"observed_at":"2026-08-12T21:54:44.358390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.363110Z","title":"Toward adaptive reasoning in large la nguage models with thought rollback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.363110Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:7f3ceb9641daf877a4638a21d3088c44d7872baf26b792991fa7a48829c710df","observation_id":"72f8a9de-81b8-4b22-95fc-112579a98c4b","resolution":{"observed_at":"2026-08-12T21:54:44.363110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.367818Z","title":"Let’s sample ste p by step: Adaptive-consistency for efﬁcient reasoning and coding with llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.367818Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:5d15f9e2fcb26c3aaa6f44840cc7cbccd1ebfb77ce0e76dd292d358287a92711","observation_id":"53203483-61a4-4798-be52-5c6a944f4049","resolution":{"observed_at":"2026-08-12T21:54:44.367818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.373472Z","title":"Do llms exhibit human-like response biases? a case study in survey design,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.373472Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:0d2da4ce1ccf5ffb3c9bc095c218d6047bd3ca2e2b15f3bb1e3599509b0c6a98","observation_id":"43eb123e-45b3-47ec-b6fe-bc2e042195ea","resolution":{"observed_at":"2026-08-12T21:54:44.373472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04105","last_updated":"2024-05-23T15:50:45Z","snapshot_observed_at":"2026-08-14T07:54:37.576606Z","submitted_at":"2024-02-06T15:59:23Z","title":"Measuring Implicit Bias in Explicitly Unbiased Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04105","snapshot_observed_at":"2026-08-12T21:54:44.378695Z","title":"Mea suring implicit bias in explicitly unbiased large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.378695Z"},"links":{"cited_paper":"/paper/2402.04105","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:089f57d4a7156fe843c17938e9faf170656999afffc3cd6a659ee945ff346dd3","observation_id":"a65973b3-b790-4e5e-bac7-6cbe33454eb5","resolution":{"observed_at":"2026-08-12T21:54:44.378695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08319","last_updated":"2024-06-22T08:31:40Z","snapshot_observed_at":"2026-08-13T06:43:50.606768Z","submitted_at":"2024-03-13T08:02:23Z","title":"Knowledge Conflicts for LLMs: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08319","snapshot_observed_at":"2026-08-12T21:54:44.384215Z","title":"Knowledge conﬂicts for llms: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.384215Z"},"links":{"cited_paper":"/paper/2403.08319","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:c0c4040744e8623eb232b39c553d9041c1c20c29095f190a5f281c7ce51b6409","observation_id":"adb0b3b9-18bc-4f4c-8355-aa956fd29a12","resolution":{"observed_at":"2026-08-12T21:54:44.384215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11495","last_updated":"2023-09-25T15:25:49Z","snapshot_observed_at":"2026-08-12T01:35:36.884518Z","submitted_at":"2023-09-20T17:50:55Z","title":"Chain-of-Verification Reduces Hallucination in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11495","snapshot_observed_at":"2026-08-12T21:54:44.389565Z","title":"Chain-of-veriﬁcation reduces hallucination in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.389565Z"},"links":{"cited_paper":"/paper/2309.11495","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:3e00ed684ae2a5753ada65e9d03714b8f50f5529d0183df3e1c3ecf72c95e764","observation_id":"f4fa5e97-6907-4ac1-9751-f7e1faeb8008","resolution":{"observed_at":"2026-08-12T21:54:44.389565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.394905Z","title":"V erify-an d-edit: A knowledge-enhanced chain-of-thought framework ,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.394905Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:06b281e4b9843e148e0dbb3d5440b0a90dc4128ca54aa6e2be3f7078da1690d8","observation_id":"6e804b9c-6db3-4301-8413-fe4b51d78d72","resolution":{"observed_at":"2026-08-12T21:54:44.394905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T21:54:44.400038Z","title":"Untangle the KNOT: Interweaving conﬂicting knowledge an d reasoning skills in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.400038Z"},"links":{"citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:e9feb76185c318cf0a5899887a4aee3e9643c5a574947d79b0d3ad388ff8f5b2","observation_id":"21bddd3e-ad78-4ce5-a5a1-e2b07d40eb45","resolution":{"observed_at":"2026-08-12T21:54:44.400038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13528","last_updated":"2023-07-26T15:17:49Z","snapshot_observed_at":"2026-08-13T10:48:15.878453Z","submitted_at":"2023-07-25T14:20:51Z","title":"FacTool: Factuality Detection in Generative AI -- A Tool Augmented Framework for Multi-Task and Multi-Domain Scenarios","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13528","snapshot_observed_at":"2026-08-12T21:54:44.405028Z","title":"Factool: Factuality detectio n in generative ai - a tool augmented framework for multi-task and multi-domain scena rios,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.405028Z"},"links":{"cited_paper":"/paper/2307.13528","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:874e998cee2ffc38e2db713d7a39af4259188f1cd44801ab1c31c31c076fd390","observation_id":"e05bec4d-d13f-46b0-84c2-c4f64c9a3a6a","resolution":{"observed_at":"2026-08-12T21:54:44.405028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":127},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 127 outbound references and 4 inbound Pith citation observations for arXiv:2411.08181."}