{"as_of":"2026-08-21T01:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:977e584fc9e47c06a7b62e599bcfb46eb1dc176cff561d57fcf18354bc1656b7","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:47:17.085295Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:53:26.084902Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T16:53:40.545243Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04141","snapshot_observed_at":"2026-08-07T13:21:43.349220Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00042","last_updated":"2025-05-28T08:39:35Z","snapshot_observed_at":"2026-08-07T13:12:36.585457Z","submitted_at":"2025-05-28T08:39:35Z","title":"Enhancing Tool Learning in Large Language Models with Hierarchical Error Checklists","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:21:43.349220Z"},"links":{"cited_paper":"/paper/2412.04141","citing_paper":"/paper/2506.00042"},"observation_digest":"sha256:e298df176ff39d5e9de6c45772cc150eed932a42cbe4be7c20448f4eeb1021f5","observation_id":"3baddb05-2c0a-4ee4-8e31-6d2488696285","resolution":{"observed_at":"2026-08-07T13:21:43.349220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"cited_work":{"arxiv_id":"2412.04141","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04141","snapshot_observed_at":"2026-06-29T16:53:40.545243Z","title":"Reducing tool hallucination via reliability alignment.arXiv preprint arXiv:2412.04141","venue":null,"work_id":"7b953ade-f109-41e6-8c17-d81d91f61258","year":2024},"citing_paper":{"arxiv_id":"2510.22977","last_updated":"2026-04-17T17:15:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-27T03:58:29Z","title":"The Reasoning Trap: How Enhancing LLM Reasoning Amplifies Tool Hallucination","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T04:09:50.183494Z"},"links":{"cited_paper":"/paper/2412.04141","citing_paper":"/paper/2510.22977"},"observation_digest":"sha256:f145dedf1068d15df80be09a7ab0ed9f01cd61d1615d144326fea533485d109a","observation_id":"62d9a328-53ab-4567-bcc8-a755495ae583","resolution":{"observed_at":"2026-05-18T04:10:51.316095Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"cited_work":{"arxiv_id":"2412.04141","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04141","snapshot_observed_at":"2026-06-29T16:53:40.545243Z","title":"Reducing tool hallucination via reliability alignment.arXiv preprint arXiv:2412.04141","venue":null,"work_id":"7b953ade-f109-41e6-8c17-d81d91f61258","year":2024},"citing_paper":{"arxiv_id":"2605.27209","last_updated":"2026-05-26T16:02:00Z","snapshot_observed_at":"2026-08-13T12:46:09.126090Z","submitted_at":"2026-05-26T16:02:00Z","title":"Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-29T16:51:36.524194Z"},"links":{"cited_paper":"/paper/2412.04141","citing_paper":"/paper/2605.27209"},"observation_digest":"sha256:a9becd70b746bf4564380ee497d84cf5ef8f5ee08356a493327c09d186fd7d06","observation_id":"8d103b0d-6cc0-4c65-b181-8adff8013200","resolution":{"observed_at":"2026-06-29T16:53:40.546847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04141","snapshot_observed_at":"2026-08-02T02:42:07.036102Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14277","last_updated":"2026-07-15T18:36:54Z","snapshot_observed_at":"2026-08-20T19:28:33.956281Z","submitted_at":"2026-07-15T18:36:54Z","title":"Multi-Head Latent Control: A Unified Interface for LLM Agent Decision Making","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T02:42:07.036102Z"},"links":{"cited_paper":"/paper/2412.04141","citing_paper":"/paper/2607.14277"},"observation_digest":"sha256:bb64542541ccf14a8583b6686a24e606c71d5fee59c2fd7a40a7a47b6e286369","observation_id":"7983dae6-b61d-4e63-859f-e7c643a02d78","resolution":{"observed_at":"2026-08-02T02:42:07.036102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04141","snapshot_observed_at":"2026-08-04T08:32:48.011938Z","title":"Reducing tool hallucination via reliability alignment, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02372","last_updated":"2026-08-03T15:15:55Z","snapshot_observed_at":"2026-08-19T05:50:47.218153Z","submitted_at":"2026-08-03T15:15:55Z","title":"PredAct-Bench: Benchmarking Tool-Augmented Dialogue under Controlled Tool Noise","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T08:32:48.011938Z"},"links":{"cited_paper":"/paper/2412.04141","citing_paper":"/paper/2608.02372"},"observation_digest":"sha256:8a699cea36a23959de53cdf17b649bd22690a79839355e38bb5446922638ebb3","observation_id":"a1028e53-6f80-4a14-af3b-5d0589a0e7ac","resolution":{"observed_at":"2026-08-04T08:32:48.011938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04141","snapshot_observed_at":"2026-08-07T19:53:26.084902Z","title":"arXiv preprint arXiv:2412.04141 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05987","last_updated":"2026-08-06T13:00:59Z","snapshot_observed_at":"2026-08-19T04:06:23.917154Z","submitted_at":"2026-08-06T13:00:59Z","title":"AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T19:53:26.084902Z"},"links":{"cited_paper":"/paper/2412.04141","citing_paper":"/paper/2608.05987"},"observation_digest":"sha256:90e94488009b36a523e9f7e70c749b8192d486f21debc36780e0be0923d6bc3a","observation_id":"2972291e-fd12-47ea-83e2-d0fd5007ea01","resolution":{"observed_at":"2026-08-07T19:53:26.084902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.04141/citation-record","integrity":"/paper/2412.04141/integrity","json":"/paper/2412.04141/citation-record.json","paper":"/paper/2412.04141"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T21:47:16.881457Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.881457Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:5d0027802f5c774c5fda5ef3b8412580c191213fe5354882663034cbd8b16e79","observation_id":"8b1d9f05-3a87-4c2a-93b3-85e12f0e9bac","resolution":{"observed_at":"2026-08-11T21:47:16.881457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13734","last_updated":"2023-10-17T09:34:30Z","snapshot_observed_at":"2026-08-01T19:59:13.992395Z","submitted_at":"2023-04-26T02:49:38Z","title":"The Internal State of an LLM Knows When It's Lying","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13734","snapshot_observed_at":"2026-08-11T21:47:16.886934Z","title":"and Mitchell, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.886934Z"},"links":{"cited_paper":"/paper/2304.13734","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:9ea58bf0fbb407b30c02424a653f9a268ce9acf86e669c4b18b6b8f7470c73d0","observation_id":"1dd6fba7-7f00-49fa-9c4a-fe47e01ecb83","resolution":{"observed_at":"2026-08-11T21:47:16.886934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.899077Z","title":"Large Language Models as Tool Makers","venue":null,"work_id":"c3aa8c35-e65f-4d13-a796-762725b80728","year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.892067Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:b4c9c6ed9317018d31bde2170793bb11a135b9b271796d8226ee6e0ae02d449c","observation_id":"601c09ed-71a7-47ae-8048-9ae9aea9196a","resolution":{"observed_at":"2026-08-11T21:47:17.903937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-19T15:08:34.393456Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-11T21:47:16.897213Z","title":"Alpagasus: Training a better alpaca with fewer data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.897213Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:76ebbaaacfb95ca33867011af58b3206f371be747af98b636b0eca22e6099ff6","observation_id":"d03f298a-26a4-4588-bc43-6b2c18c64fd2","resolution":{"observed_at":"2026-08-11T21:47:16.897213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14033","last_updated":"2024-01-15T03:18:25Z","snapshot_observed_at":"2026-08-18T10:53:24.646048Z","submitted_at":"2023-12-21T17:02:06Z","title":"T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14033","snapshot_observed_at":"2026-08-11T21:47:16.902502Z","title":"T-Eval: Evaluating the Tool Utilization Capability Step by Step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.902502Z"},"links":{"cited_paper":"/paper/2312.14033","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:9f9d8ec1baef21447e87d3b9ba015684f156fda34de4d81d4d8cca207734db8b","observation_id":"e0afa8f4-f3d4-40e8-a2ed-e27880181b6d","resolution":{"observed_at":"2026-08-11T21:47:16.902502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T21:47:16.907887Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.907887Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:99c4775110dd07c6d6521a9d76773a235349ad297d55e20abb81f61f6910cdb0","observation_id":"2cc2ba72-73c6-40a8-a58b-bfa7f366c7ef","resolution":{"observed_at":"2026-08-11T21:47:16.907887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-11T21:47:16.913515Z","title":"Retrieval-augmented generation for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.913515Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:bd60942e0dc7b853e18c5d88a43b89656b16dc7ecd7f062e9f678c5429637ffd","observation_id":"2082df96-eea7-47d3-96df-3daef9635b9f","resolution":{"observed_at":"2026-08-11T21:47:16.913515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.884754Z","title":"Gemini: A Family of Highly Capable Multimodal Models , 2023","venue":null,"work_id":"df976131-8256-41a0-94d6-03f6c7c59bdc","year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.918273Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:3d341c1a88cc1a9724700be01adaa4410da6a067ea28e5730989d1d94307fc2d","observation_id":"ec8361ee-2b0d-4ac6-bca9-63dcbf0b97f2","resolution":{"observed_at":"2026-08-11T21:47:17.889426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.870524Z","title":"M., Alves, D","venue":null,"work_id":"9f8d90fb-21da-460e-aa8c-16d3f9385d23","year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.923066Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:f554d00f26c5b1f405269cf65e9dbaae50805a75e5eb3a271c201fb5b4361ffa","observation_id":"b2c20101-c8f8-47ab-8512-082cb6e7b28a","resolution":{"observed_at":"2026-08-11T21:47:17.875105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07714","last_updated":"2025-03-05T07:39:03Z","snapshot_observed_at":"2026-08-19T14:24:16.776673Z","submitted_at":"2024-03-12T14:57:40Z","title":"StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07714","snapshot_observed_at":"2026-08-11T21:47:16.927708Z","title":"Stabletoolbench: Towards stable large-scale benchmarking on tool learning of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.927708Z"},"links":{"cited_paper":"/paper/2403.07714","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:4270ea4610c8f0a84228beb5bd766bd0910b7ee17dfc73ab986e4e15d61ee0fc","observation_id":"42254d59-7427-4d35-8a4b-b170e10061f9","resolution":{"observed_at":"2026-08-11T21:47:16.927708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.856247Z","title":"and Kembhavi, A","venue":null,"work_id":"756b7caf-b021-40ec-9e85-6332557ad645","year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.932692Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:7ff6f2f70d34faae05270a8a6beaeeab54afa89c55d6804c03c43a0ab08387b3","observation_id":"e95b84db-9567-4dd0-813f-b50ba7648480","resolution":{"observed_at":"2026-08-11T21:47:17.860965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11554","last_updated":"2024-01-15T23:52:21Z","snapshot_observed_at":"2026-08-17T00:59:25.531672Z","submitted_at":"2023-05-19T09:54:21Z","title":"ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11554","snapshot_observed_at":"2026-08-11T21:47:16.937036Z","title":"ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.937036Z"},"links":{"cited_paper":"/paper/2305.11554","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:a82e3a3b1a570a439890ee346c77a835394f83fb2a6ab3c8f8fd13080c637c54","observation_id":"aca268e8-e79a-4e1b-8916-2bf739095be8","resolution":{"observed_at":"2026-08-11T21:47:16.937036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:16.941533Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.941533Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:1588e1390f40cbaf898d3a87c1caa7e52b523d152f2111cd485e318cd46c03d1","observation_id":"a709d7dc-2dac-4bb6-92e2-e96cd6b5f06d","resolution":{"observed_at":"2026-08-11T21:47:16.941533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00675","last_updated":"2023-08-01T17:21:38Z","snapshot_observed_at":"2026-08-16T15:11:32.907301Z","submitted_at":"2023-08-01T17:21:38Z","title":"Tool Documentation Enables Zero-Shot Tool-Usage with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00675","snapshot_observed_at":"2026-08-11T21:47:16.945817Z","title":"Tool documentation enables zero-shot tool-usage with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.945817Z"},"links":{"cited_paper":"/paper/2308.00675","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:024b0ad6d383b93c7111feec9622f543e40fd64022685bbc4f942f53278c23e4","observation_id":"8f73952d-bf56-485f-abb2-87369d3abaa8","resolution":{"observed_at":"2026-08-11T21:47:16.945817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09726","last_updated":"2024-07-13T00:16:26Z","snapshot_observed_at":"2026-08-16T13:34:35.857413Z","submitted_at":"2024-07-13T00:16:26Z","title":"On Mitigating Code LLM Hallucinations with API Documentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09726","snapshot_observed_at":"2026-08-11T21:47:16.950405Z","title":"K., and Kumar, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.950405Z"},"links":{"cited_paper":"/paper/2407.09726","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:ab7a6540c9015d0a5148cad352e810ac5870c0edb523675ade219cdccf240409","observation_id":"883f2f3f-6a0e-49f7-8172-146583f1ea1a","resolution":{"observed_at":"2026-08-11T21:47:16.950405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:16.954966Z","title":"J., Madotto, A., and Fung, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.954966Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:4d6859bb00ba75b6a8167c26f89a33af3ebb2a079535889cc78ba5e5126317bd","observation_id":"93c6a6fd-83bb-4887-b858-9585e6126a0d","resolution":{"observed_at":"2026-08-11T21:47:16.954966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:16.959156Z","title":"GeneGPT: augmenting large language models with domain tools for improved access to biomedical information","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.959156Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:50b342aaf69dfb29227441f193092ac39c73bea8dab97406888893cc9a753935","observation_id":"8376b122-32f5-4d73-986b-8f6df5d279b0","resolution":{"observed_at":"2026-08-11T21:47:16.959156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.823436Z","title":"Crafting papers on machine learning","venue":null,"work_id":"5b5f242d-4131-4cb0-9315-8ff8c5c6ea77","year":2000},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.963725Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:2c56e504a3862ede23c34f973c49c3f4ba6c8c26333331e447588c83d8d8591b","observation_id":"547486c5-8e80-4616-ac2c-f9a91c7ecdcb","resolution":{"observed_at":"2026-08-11T21:47:17.828369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14251","last_updated":"2023-10-11T05:27:50Z","snapshot_observed_at":"2026-08-19T19:54:57.212265Z","submitted_at":"2023-05-23T17:06:00Z","title":"FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14251","snapshot_observed_at":"2026-08-11T21:47:16.968271Z","title":"W., Iyyer, M., Zettlemoyer, L., and Hajishirzi, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.968271Z"},"links":{"cited_paper":"/paper/2305.14251","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:1f2f79656564393550b4eed5500fdda3bcfd1759125ca83820bc5d67480590ad","observation_id":"e21cd200-3579-4915-9d7b-07eff3b8b5b7","resolution":{"observed_at":"2026-08-11T21:47:16.968271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15852","last_updated":"2024-03-15T21:04:34Z","snapshot_observed_at":"2026-08-16T15:29:49.848201Z","submitted_at":"2023-05-25T08:43:46Z","title":"Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15852","snapshot_observed_at":"2026-08-11T21:47:16.972775Z","title":"Self-contradictory hallucinations of large language models: Evaluation, detection and mitigation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.972775Z"},"links":{"cited_paper":"/paper/2305.15852","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:b0ca450fa47f39fe7869a3fc7d99cd57c471274fcb75c2511956cb99d4a61759","observation_id":"ed12755a-886b-458a-b006-0db34eb03de8","resolution":{"observed_at":"2026-08-11T21:47:16.972775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-08-20T10:31:15.813764Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-11T21:47:16.977314Z","title":"G., Zhang, T., Wang, X., and Gonzalez, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.977314Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:ee8bcebb02348dee114d93df707f512ec2adf55328121c6af5d14f556d49256f","observation_id":"2f7b2f93-87cf-489e-acc2-c791a3f64201","resolution":{"observed_at":"2026-08-11T21:47:16.977314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-08-20T04:37:17.931952Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-08-11T21:47:16.982221Z","title":"The RefinedWeb dataset for Falcon LLM: outperforming curated corpora with web data, and web data only","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.982221Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:c0ab93d9deea24c39695d8a08541ff24f01f53a7980c2485bf0f521d1e42d473","observation_id":"8834674d-56b9-417d-aa1f-190df9c96539","resolution":{"observed_at":"2026-08-11T21:47:16.982221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06849","last_updated":"2023-05-23T13:15:10Z","snapshot_observed_at":"2026-08-16T15:33:50.774312Z","submitted_at":"2023-05-11T14:47:29Z","title":"WebCPM: Interactive Web Search for Chinese Long-form Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06849","snapshot_observed_at":"2026-08-11T21:47:16.987237Z","title":"WebCPM: Interactive Web Search for Chinese Long-form Question Answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.987237Z"},"links":{"cited_paper":"/paper/2305.06849","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:9e41403afc34b56997df6e7390d151d99b021ec88d4ecd15f6119cb40abcf88e","observation_id":"312c704c-7bc3-4c3c-8c2f-60c334d3bb2e","resolution":{"observed_at":"2026-08-11T21:47:16.987237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.808688Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs , 2023 b","venue":null,"work_id":"92c2820f-e7a9-4dab-8ed1-73d1b5aa8595","year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.992285Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:b911b9fdcb724be09c283245d5d3955875904b4cbf677ee62a650603d432dc0f","observation_id":"91bb3e31-7ff4-41f2-aa5c-372922666d3d","resolution":{"observed_at":"2026-08-11T21:47:17.813437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08354","last_updated":"2024-08-06T15:14:36Z","snapshot_observed_at":"2026-08-15T21:51:52.440582Z","submitted_at":"2023-04-17T15:16:10Z","title":"Tool Learning with Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08354","snapshot_observed_at":"2026-08-11T21:47:16.996711Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:16.996711Z"},"links":{"cited_paper":"/paper/2304.08354","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:b3f05988a699d8e53fd358e5f914c3c21372256d6b2ec796bb09eaab1a2eea09","observation_id":"845f9018-31ce-4e61-85ea-c165325176c7","resolution":{"observed_at":"2026-08-11T21:47:16.996711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.001677Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.001677Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:14be8ba3469ed6205196e35e85df88d65f996da78c85fce64b224cc131df6640","observation_id":"d7308864-700f-439f-b489-0efc2dd0042b","resolution":{"observed_at":"2026-08-11T21:47:17.001677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-11T21:47:17.006563Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.006563Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:4c21e4086ff9ddcb80e04385552e91b3d0d5b482e79e32cddfeb1b06b498e90b","observation_id":"8969e862-97c1-4edf-b80e-cd7fc7e00b66","resolution":{"observed_at":"2026-08-11T21:47:17.006563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14739","last_updated":"2023-05-24T05:19:15Z","snapshot_observed_at":"2026-08-20T15:58:19.988105Z","submitted_at":"2023-05-24T05:19:15Z","title":"Trusting Your Evidence: Hallucinate Less with Context-aware Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14739","snapshot_observed_at":"2026-08-11T21:47:17.011819Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.011819Z"},"links":{"cited_paper":"/paper/2305.14739","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:d33df5a366156a4e6d89b594ff18d575d1cb3331c9e94ecdcc302c5b7d259820","observation_id":"7142ddb2-c30f-4148-9ebc-d4004ebd596a","resolution":{"observed_at":"2026-08-11T21:47:17.011819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.784226Z","title":"ToolAlpaca: Generalized Tool Learning for Language Models with 3000 Simulated Cases , 2023","venue":null,"work_id":"7d7d7631-dffa-4446-9225-ae1faf9e509c","year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.016619Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:1a67554955d7ec355f56e8337d6ee9c7a3d06fe14c423be6f5702fe36e0f86fe","observation_id":"75b9f10c-2e33-4a2e-aa39-a931779fcda8","resolution":{"observed_at":"2026-08-11T21:47:17.789095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T21:47:17.021017Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.021017Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:0a1871d71fd5bf59775b01d02deef8a67e323805cf7691349cba6c0ba95ddd76","observation_id":"a0914f47-78bd-42f1-8807-3b652bc1b636","resolution":{"observed_at":"2026-08-11T21:47:17.021017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03987","last_updated":"2023-08-12T14:57:37Z","snapshot_observed_at":"2026-08-19T14:31:08.755572Z","submitted_at":"2023-07-08T14:25:57Z","title":"A Stitch in Time Saves Nine: Detecting and Mitigating Hallucinations of LLMs by Validating Low-Confidence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03987","snapshot_observed_at":"2026-08-11T21:47:17.025661Z","title":"A stitch in time saves nine: Detecting and mitigating hallucinations of llms by validating low-confidence generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.025661Z"},"links":{"cited_paper":"/paper/2307.03987","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:03fb868fbae60ce25dadca1e3212977a9b18d3c9ac9f0ca0d8863aca6e9bcc33","observation_id":"485c4e8a-9211-4c21-bd0e-4ba147db3a32","resolution":{"observed_at":"2026-08-11T21:47:17.025661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-08-15T10:58:51.256503Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-11T21:47:17.030332Z","title":"Can llms express their uncertainty? an empirical evaluation of confidence elicitation in llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.030332Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:d5f7a3bd5c560247cf2e969f273de242ccc2665534bac4afa4dcfc5ed3df8133","observation_id":"2ee8a57e-5458-4eea-ac76-330775e4aa7b","resolution":{"observed_at":"2026-08-11T21:47:17.030332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18349","last_updated":"2024-08-08T08:57:23Z","snapshot_observed_at":"2026-08-16T14:05:59.232389Z","submitted_at":"2024-03-27T08:39:56Z","title":"Rejection Improves Reliability: Training LLMs to Refuse Unknown Questions Using RL from Knowledge Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18349","snapshot_observed_at":"2026-08-11T21:47:17.035095Z","title":"Rejection improves reliability: Training llms to refuse unknown questions using rl from knowledge feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.035095Z"},"links":{"cited_paper":"/paper/2403.18349","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:50da2fde8557fe163a94c2c345b04dbebaa0ddbc125b1c67952a9caff8a05eb4","observation_id":"e2b5f1c6-d734-4c3a-837e-7738d504c989","resolution":{"observed_at":"2026-08-11T21:47:17.035095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06708","last_updated":"2025-03-09T17:55:49Z","snapshot_observed_at":"2026-08-16T12:51:45.113135Z","submitted_at":"2025-03-09T17:55:49Z","title":"Alignment for Efficient Tool Calling of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06708","snapshot_observed_at":"2026-08-11T21:47:17.039661Z","title":"Alignment for efficient tool calling of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.039661Z"},"links":{"cited_paper":"/paper/2503.06708","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:b48a8a542ae4ba24acca40fce5e3dd7246832a1cc1a51d3d7d93834a3541dc55","observation_id":"47d9299b-f252-4d96-9ac6-4598e20d4fe4","resolution":{"observed_at":"2026-08-11T21:47:17.039661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-11T21:47:17.044367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.044367Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:5e8473642bcc45b0d51b15443e59b07cbd0cee5481b8cea98aec8335a31b3caf","observation_id":"2f95929d-6260-409c-a06d-a22f4e9c41b8","resolution":{"observed_at":"2026-08-11T21:47:17.044367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11489","last_updated":"2024-01-30T12:11:45Z","snapshot_observed_at":"2026-08-16T15:22:34.748939Z","submitted_at":"2023-06-20T12:21:06Z","title":"Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11489","snapshot_observed_at":"2026-08-11T21:47:17.048885Z","title":"ChatGPT is not Enough: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.048885Z"},"links":{"cited_paper":"/paper/2306.11489","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:6ff1c113aa90318e4a2e88944af57811db6c7f9c2903016cca2277ce0f6d05e3","observation_id":"f9e33d0c-17f9-4403-a547-e7af18eefd77","resolution":{"observed_at":"2026-08-11T21:47:17.048885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.767129Z","title":"WebShop: Towards Scalable Real-World Web Interaction with Grounded Language Agents","venue":null,"work_id":"4505f723-3e1b-4371-8941-27180de5849f","year":2022},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.053419Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:30f286da3a21b8248ce3ead507b163894e237ce3fa7711be6117230de9f60ed6","observation_id":"660c7d82-e4e1-4892-beb7-f3a2a94941fc","resolution":{"observed_at":"2026-08-11T21:47:17.773493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07745","last_updated":"2025-08-17T06:06:35Z","snapshot_observed_at":"2026-08-20T11:46:47.702971Z","submitted_at":"2024-10-10T09:23:26Z","title":"StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07745","snapshot_observed_at":"2026-08-11T21:47:17.057484Z","title":"Steptool: A step-grained reinforcement learning framework for tool learning in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.057484Z"},"links":{"cited_paper":"/paper/2410.07745","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:f5aa8435a88d3603b24c7b95620e174b10b910436865f063bcdfbf638359d800","observation_id":"94888ca9-52c9-4ee2-b4a7-f5f3c3aabfd3","resolution":{"observed_at":"2026-08-11T21:47:17.057484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.062005Z","title":"Instruction tuning for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.062005Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:481e1ca22bca2c87b13380a2d318ef41224339d430e694c6a1dce0ef00fcdb91","observation_id":"f2c53a25-da9f-4e2e-8afe-802eb59bcd5a","resolution":{"observed_at":"2026-08-11T21:47:17.062005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20015","last_updated":"2024-10-04T07:51:29Z","snapshot_observed_at":"2026-08-18T13:56:56.933519Z","submitted_at":"2024-06-28T16:03:30Z","title":"ToolBeHonest: A Multi-level Hallucination Diagnostic Benchmark for Tool-Augmented Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20015","snapshot_observed_at":"2026-08-11T21:47:17.066252Z","title":"Toolbehonest: A multi-level hallucination diagnostic benchmark for tool-augmented large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.066252Z"},"links":{"cited_paper":"/paper/2406.20015","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:f36f12c8bca486e652336f3a86748036aff8e7fce78d202625a06c8eacb1d723","observation_id":"a162cb5d-ab0e-473a-9ff9-4827dec9ee5e","resolution":{"observed_at":"2026-08-11T21:47:17.066252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03268","last_updated":"2023-05-05T03:49:14Z","snapshot_observed_at":"2026-08-18T18:20:36.163515Z","submitted_at":"2023-05-05T03:49:14Z","title":"Verify-and-Edit: A Knowledge-Enhanced Chain-of-Thought Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03268","snapshot_observed_at":"2026-08-11T21:47:17.070929Z","title":"Verify-and-edit: A knowledge-enhanced chain-of-thought framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.070929Z"},"links":{"cited_paper":"/paper/2305.03268","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:d4ee0fffc490d8282f23fecb2bb2647818c3c82139c066eda3f2a31cc0327526","observation_id":"0139cb11-cd07-4bfa-9736-35407c23b7d1","resolution":{"observed_at":"2026-08-11T21:47:17.070929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:47:17.076073Z","title":"Enhancing llm reliability via explicit knowledge boundary modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.076073Z"},"links":{"citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:d43998e52c6af7d0fbd5e6861c4163bb13e18ebbea2c82010a048bfdb646033b","observation_id":"f1e0a239-501e-4450-9804-0fdc96898cbf","resolution":{"observed_at":"2026-08-11T21:47:17.076073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11206","last_updated":"2023-05-18T17:45:22Z","snapshot_observed_at":"2026-08-08T19:18:06.171048Z","submitted_at":"2023-05-18T17:45:22Z","title":"LIMA: Less Is More for Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11206","snapshot_observed_at":"2026-08-11T21:47:17.080503Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.080503Z"},"links":{"cited_paper":"/paper/2305.11206","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:1f3aa589470fd6c27030eb26331ccc24de55352f91f70471de43bdb532c47652","observation_id":"cba75c2f-91f0-4a24-af84-0c48f34332a2","resolution":{"observed_at":"2026-08-11T21:47:17.080503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13304","last_updated":"2023-06-23T05:43:28Z","snapshot_observed_at":"2026-08-19T05:45:53.973699Z","submitted_at":"2023-06-23T05:43:28Z","title":"ToolQA: A Dataset for LLM Question Answering with External Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13304","snapshot_observed_at":"2026-08-11T21:47:17.085295Z","title":"ToolQA: A Dataset for LLM Question Answering with External Tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T21:47:17.085295Z"},"links":{"cited_paper":"/paper/2306.13304","citing_paper":"/paper/2412.04141"},"observation_digest":"sha256:51085aac4cbd92e63815288764d29523fde435bf58729edc00bd580f0f598333","observation_id":"56fd37ba-2f00-48d8-b6e5-a51d06708945","resolution":{"observed_at":"2026-08-11T21:47:17.085295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.04141","last_updated":"2025-05-29T08:04:32Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T00:09:02.045110Z","submitted_at":"2024-12-05T13:10:54Z","title":"Reducing Tool Hallucination via Reliability Alignment"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 6 inbound Pith citation observations for arXiv:2412.04141."}