{"as_of":"2026-08-09T23:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e8d83b240c7755fea6e1d2d2f50f44f6b8616f3d017daa4edb568d99f9aa0f0","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:35:44.323361Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:33:46.563630Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:28:44.597412Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14599","snapshot_observed_at":"2026-08-05T15:33:46.563630Z","title":"Xiong, E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19780","last_updated":"2025-08-27T11:04:05Z","snapshot_observed_at":"2026-08-08T22:50:45.220710Z","submitted_at":"2025-08-27T11:04:05Z","title":"Interestingness First Classifiers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T15:33:46.563630Z"},"links":{"cited_paper":"/paper/2505.14599","citing_paper":"/paper/2508.19780"},"observation_digest":"sha256:a178fe5bc35f2ea68d11d926065986268c95fff7ff04f4c2a1e903d342eca234","observation_id":"6b7b2aa5-0e2d-4124-8482-8d7427b61194","resolution":{"observed_at":"2026-08-05T15:33:46.563630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"cited_work":{"arxiv_id":"2505.14599","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14599","snapshot_observed_at":"2026-07-03T17:28:44.597412Z","title":"Toward reliable scientific hypothesis generation: Evaluat- ing truthfulness and hallucination in large language models.arXiv preprint arXiv:2505.14599, 2025","venue":null,"work_id":"9751e9fd-eef2-479f-b64a-60714f4c6f8c","year":2025},"citing_paper":{"arxiv_id":"2606.15893","last_updated":"2026-06-22T03:05:35Z","snapshot_observed_at":"2026-08-04T09:50:38.097939Z","submitted_at":"2026-06-14T16:25:59Z","title":"BALTO: Balanced Token-Level Policy Optimization for Hallucination Mitigation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T04:07:26.224919Z"},"links":{"cited_paper":"/paper/2505.14599","citing_paper":"/paper/2606.15893"},"observation_digest":"sha256:7a3c92078bf668ac277683b0b688bde83e7c8121100deed296243f01bd8ad580","observation_id":"44bf4178-6d59-45d0-879b-bc8a3ba14c66","resolution":{"observed_at":"2026-07-03T17:28:44.598968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14599/citation-record","integrity":"/paper/2505.14599/integrity","json":"/paper/2505.14599/citation-record.json","paper":"/paper/2505.14599"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.12258","last_updated":"2025-05-08T09:15:15Z","snapshot_observed_at":"2026-08-09T19:15:08.465019Z","submitted_at":"2024-05-20T11:40:23Z","title":"Scientific Hypothesis Generation by a Large Language Model: Laboratory Validation in Breast Cancer Treatment","version":3},"cited_work":{"arxiv_id":"2405.12258","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12258","snapshot_observed_at":"2026-08-07T15:35:44.777026Z","title":"Scientific Hypothesis Generation by a Large Language Model: Laboratory Validation in Breast Cancer Treatment","venue":"q-bio.QM","work_id":"d6692ab4-33b4-4d2e-b2d2-72ce979752f1","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.097720Z"},"links":{"cited_paper":"/paper/2405.12258","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:357e4f8473a21409f2891ae2d7b5bcb15250e9639bc79023f42b76229aa1f21d","observation_id":"5197324c-4360-41e6-9a7a-06d6e70faee5","resolution":{"observed_at":"2026-08-07T15:35:44.781859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:35:44.102339Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.102339Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:e4c5a533b98a7a6c617b7439d9ff3fe3d5570ca7ef4fdc1d788267f66240f8f4","observation_id":"98fee1f0-be9b-47d0-b0d5-203e00306dc6","resolution":{"observed_at":"2026-08-07T15:35:44.102339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07738","last_updated":"2025-02-09T08:15:44Z","snapshot_observed_at":"2026-07-06T17:58:52.016903Z","submitted_at":"2024-04-11T13:36:29Z","title":"ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07738","snapshot_observed_at":"2026-08-07T15:35:44.106103Z","title":"Researchagent: Iterative research idea generation over scientific literature with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.106103Z"},"links":{"cited_paper":"/paper/2404.07738","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:67abe4877d241dd1811fadb9c873c1e769d1292259cb102acad3ae4626d80669","observation_id":"d75a0f51-d44e-4073-9724-2b0c754c90ad","resolution":{"observed_at":"2026-08-07T15:35:44.106103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11648","last_updated":"2023-06-20T16:16:56Z","snapshot_observed_at":"2026-08-07T22:44:57.786072Z","submitted_at":"2023-06-20T16:16:56Z","title":"Harnessing the Power of Adversarial Prompting and Large Language Models for Robust Hypothesis Generation in Astronomy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11648","snapshot_observed_at":"2026-08-07T15:35:44.109864Z","title":"Harnessing the power of adversarial prompting and large language models for robust hypothesis generation in astronomy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.109864Z"},"links":{"cited_paper":"/paper/2306.11648","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:0ce80f8d0a51887838efb5dfb8cc2f180737bb2407a035240610e4bd398bd472","observation_id":"b968f917-a696-46f1-ae1f-d11dcaa7c6e1","resolution":{"observed_at":"2026-08-07T15:35:44.109864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04259","last_updated":"2024-01-08T22:24:17Z","snapshot_observed_at":"2026-08-07T22:46:31.467173Z","submitted_at":"2024-01-08T22:24:17Z","title":"MARG: Multi-Agent Review Generation for Scientific Papers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04259","snapshot_observed_at":"2026-08-07T15:35:44.114139Z","title":"Marg: Multi-agent review generation for scientific papers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.114139Z"},"links":{"cited_paper":"/paper/2401.04259","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:e1edacd83b0f7383801539fd1ad13bb78b9fb3bff985f58c3a2e7cf2fda2aae9","observation_id":"21bc12ea-1b9a-4e55-b724-de1c9e31d1d0","resolution":{"observed_at":"2026-08-07T15:35:44.114139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-07T08:20:39.814613Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-07T15:35:44.117891Z","title":"Towards a rigorous science of interpretable machine learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.117891Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:fe111d0a9673b2ac7aa9909746dbd5dc89f4800e4aca056109396239a52984dd","observation_id":"d6b4a4ee-51b0-425e-bbdc-a078bd72cb90","resolution":{"observed_at":"2026-08-07T15:35:44.117891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:35:44.122791Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.122791Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:8c51acfc9b3f7e5cd3ea4d953e4808d51413fb4eb47646d4937587175f9cebb7","observation_id":"821683c7-0cae-4cae-aff7-03eae1b46040","resolution":{"observed_at":"2026-08-07T15:35:44.122791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.164270Z","title":"On the creativity of large language models","venue":null,"work_id":"f171c993-3bcd-4231-915f-f6bd8941fabc","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.126501Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:278e38ecadbbced3f19b0f3c834f74549698d3979901a992a62d0eb37addb0d6","observation_id":"052e5752-5177-406d-9e1e-279669a86186","resolution":{"observed_at":"2026-08-07T15:35:45.167874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08640","last_updated":"2025-06-11T07:14:34Z","snapshot_observed_at":"2026-08-04T19:28:53.520817Z","submitted_at":"2024-02-13T18:09:38Z","title":"Forecasting high-impact research topics via machine learning on evolving knowledge graphs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08640","snapshot_observed_at":"2026-08-07T15:35:44.130125Z","title":"Forecasting high-impact research topics via machine learning on evolving knowledge graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.130125Z"},"links":{"cited_paper":"/paper/2402.08640","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:400f7c6b697bd6e55964e1df0b5b79dd676a2a92558d83ce4c6354cc8d655735","observation_id":"2c560203-9948-4f9e-be1c-1a8d1fd1837c","resolution":{"observed_at":"2026-08-07T15:35:44.130125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.151225Z","title":"Embracing foundation models for advancing scientific discovery","venue":null,"work_id":"ddf16bef-0b5e-4144-8999-48d71f16d575","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.134128Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:bbdb07350a45a50bf76d33af4acc15609d84942b550022110f2256586ad862bc","observation_id":"078e0045-d96a-4f5b-ba3d-4d2ab23a8e3b","resolution":{"observed_at":"2026-08-07T15:35:45.155434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.137829Z","title":"Williams, Stefan Bekiranov, and Aidong Zhang","venue":null,"work_id":"ab8a3865-4479-4c60-9fef-0d28d38bd9b0","year":2025},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.137708Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:958eb08a9e77be3c19eb6c8232835035172f9f6f4b63c03252f2c26c78ca96b2","observation_id":"ce3f7d09-122c-4d91-8f0b-3a17a80fa916","resolution":{"observed_at":"2026-08-07T15:35:45.141899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14255","last_updated":"2024-10-27T04:02:32Z","snapshot_observed_at":"2026-07-06T19:35:48.603411Z","submitted_at":"2024-10-18T08:04:36Z","title":"Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14255","snapshot_observed_at":"2026-08-07T15:35:44.141222Z","title":"Nova: An iterative planning and search approach to enhance novelty and diversity of llm generated ideas","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.141222Z"},"links":{"cited_paper":"/paper/2410.14255","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:724ac9d58317e8af26e68d088e4b3c3df9608696c0ee492849c2019f73632ef3","observation_id":"e72d0f18-290b-4063-9601-5531f8ea2455","resolution":{"observed_at":"2026-08-07T15:35:44.141222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-07T15:35:44.145049Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.145049Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:e7def702ab353f20c3477e216dd97fc9d72b10ae8b5ad6e5a487208cca6b8873","observation_id":"92c8de35-1753-4ea2-b776-27d4d7a51810","resolution":{"observed_at":"2026-08-07T15:35:44.145049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.125204Z","title":"Autonomous llm-driven research—from data to human-verifiable research papers","venue":null,"work_id":"17f635dd-910e-457d-b37d-fc5053c55417","year":2025},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.148710Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:6a2e55129e83cfd496bc1279a53ec984e68a5b22ea2b68630b058b71a30c3544","observation_id":"0f3e372c-3071-4cf0-904a-7b26a0249b90","resolution":{"observed_at":"2026-08-07T15:35:45.129310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.112730Z","title":"A survey on knowledge graphs: Representation, acquisition, and applications","venue":null,"work_id":"aba9afc0-e11d-45ff-89c9-047e5df9c5ac","year":2021},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.152298Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:280782c08b4767ce0747872d1ab8c42a1d98b9e0981df825eda734a9d9181702","observation_id":"9a6072e4-059b-4e8d-b8f1-60a953be7027","resolution":{"observed_at":"2026-08-07T15:35:45.116440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18856","last_updated":"2026-05-18T21:55:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-24T15:41:56Z","title":"Entry-level guide to the use of large language models for medical research","version":4},"cited_work":{"arxiv_id":"2410.18856","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18856","snapshot_observed_at":"2026-08-07T15:35:44.638348Z","title":"Entry-level guide to the use of large language models for medical research","venue":"cs.AI","work_id":"ca3ae099-cab1-47a0-9549-9e96f9790a97","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.155536Z"},"links":{"cited_paper":"/paper/2410.18856","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:7190f7c6a45b1916931e540aac3728d802b030e550ef2d03f9f33149ed031844","observation_id":"dcc46d8b-f53b-4709-a0b4-9691795dea8b","resolution":{"observed_at":"2026-08-07T15:35:44.642806Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.098987Z","title":"Large language models versus natural language understanding and generation","venue":null,"work_id":"351e3698-93e2-45bf-b0fb-e7f06c09873e","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.159783Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:32b43af7ebe1e56432b88fc07f84ef5bcd1504a350490890928fb1fc7b233487","observation_id":"503862d8-5a8a-48d2-b160-cc04042c0288","resolution":{"observed_at":"2026-08-07T15:35:45.103276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.085819Z","title":"Forecasting the future of artificial intelligence with machine learning-based link prediction in an exponentially growing knowledge network","venue":null,"work_id":"033bfd78-5dfe-49da-ac73-0d0bf360e370","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.164595Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:506e8e24d7f94b80f828982b9d68f97f7adee97b6f5d25208b7110ce1d0ab634","observation_id":"145eb18e-99cd-41ff-9318-6d895e73f6bc","resolution":{"observed_at":"2026-08-07T15:35:45.089819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15551","last_updated":"2023-07-31T21:39:01Z","snapshot_observed_at":"2026-08-07T11:29:31.821479Z","submitted_at":"2023-06-27T15:23:42Z","title":"MyCrunchGPT: A chatGPT assisted framework for scientific machine learning","version":2},"cited_work":{"arxiv_id":"2306.15551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.15551","snapshot_observed_at":"2026-08-07T15:35:44.620328Z","title":"MyCrunchGPT: A chatGPT assisted framework for scientific machine learning","venue":"cs.LG","work_id":"4d0506d8-d39b-484f-981e-ce17ade5e91f","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.168145Z"},"links":{"cited_paper":"/paper/2306.15551","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:1db1ca6f5ca022ba00fec02200edf56672b149eb51ba98806c61db2b5cb3317d","observation_id":"3b121a38-41eb-4888-8e39-c167c0f2ccec","resolution":{"observed_at":"2026-08-07T15:35:44.624537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07559","last_updated":"2023-12-14T19:40:04Z","snapshot_observed_at":"2026-07-06T17:00:41.729445Z","submitted_at":"2023-12-08T18:50:20Z","title":"PaperQA: Retrieval-Augmented Generative Agent for Scientific Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07559","snapshot_observed_at":"2026-08-07T15:35:44.171915Z","title":"Paperqa: Retrieval-augmented generative agent for scientific research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.171915Z"},"links":{"cited_paper":"/paper/2312.07559","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:e263c8311b0f565cf593b84177b69f79118bb51e0f317311644a0ef147f161b4","observation_id":"a58a1df5-fa8b-4564-81cc-b1a410462f83","resolution":{"observed_at":"2026-08-07T15:35:44.171915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.176053Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.176053Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:67a89e904e97a0193868070aeba077ff887a8a2fa881cc12b138086c7c9c5da5","observation_id":"c74ed565-c5e3-4cc6-b800-1924174ea04b","resolution":{"observed_at":"2026-08-07T15:35:44.176053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13185","last_updated":"2024-10-30T09:17:59Z","snapshot_observed_at":"2026-08-07T12:16:59.609877Z","submitted_at":"2024-10-17T03:26:37Z","title":"Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13185","snapshot_observed_at":"2026-08-07T15:35:44.179758Z","title":"Chain of ideas: Revolutionizing research via novel idea development with llm agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.179758Z"},"links":{"cited_paper":"/paper/2410.13185","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:729fcff9d22afb43f449e621968ddd403946e8afeff534763e5a8e1723e180ff","observation_id":"a5522196-0f18-4a30-afeb-0cd1dd39e4bf","resolution":{"observed_at":"2026-08-07T15:35:44.179758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.063563Z","title":"Learning entity and relation embeddings for knowledge graph completion","venue":null,"work_id":"885fd82d-c8dd-4cc0-9275-f36268d31ab4","year":2015},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.184160Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:97451dfb1bcee5d642bc2c8568b61b3e4cd19a7976cdb44764852f4e05f36813","observation_id":"65eece7d-9619-4b6d-b092-ef1cbcf8df27","resolution":{"observed_at":"2026-08-07T15:35:45.067795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00865","last_updated":"2023-07-03T09:08:01Z","snapshot_observed_at":"2026-08-07T23:45:27.698266Z","submitted_at":"2023-07-03T09:08:01Z","title":"A Survey on Graph Classification and Link Prediction based on GNN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00865","snapshot_observed_at":"2026-08-07T15:35:44.187587Z","title":"A survey on graph classification and link prediction based on gnn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.187587Z"},"links":{"cited_paper":"/paper/2307.00865","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:02d40f01f07619e38f1fc845a64c124a18ea616f98e996eaa4b703642d63f680","observation_id":"a34e5c1d-b18a-41b8-bbb1-7aff8bfd6039","resolution":{"observed_at":"2026-08-07T15:35:44.187587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.050570Z","title":"Conversational drug editing using retrieval and domain feedback","venue":null,"work_id":"1272c267-b6d2-4d00-bf71-8e739fb3b4ff","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.191267Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:3bd3fde5517624b4c6476a5b39755b75de79b088a9cbc3801806425ee144aa5f","observation_id":"b550870d-7087-4183-90c4-a14ffc558b16","resolution":{"observed_at":"2026-08-07T15:35:45.054613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.037720Z","title":"Application of explainable artificial intelligence for healthcare: A systematic review of the last decade (2011--2022)","venue":null,"work_id":"8ecb709d-38b2-48eb-bae8-8bb44bf7b99a","year":2011},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.194938Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:7719525473fb9e30395bb536d9875002596e82bf56555a46630adccc602ffb43","observation_id":"b949a6cd-c77f-416c-96e9-f17a3fcd3dbe","resolution":{"observed_at":"2026-08-07T15:35:45.041748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.025850Z","title":"Improving biomedical information retrieval with neural retrievers","venue":null,"work_id":"4c4a2fb4-01d2-4b71-955d-de45f5cd5ade","year":2022},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.198460Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:3605bb95f62080f16efa4e6f5d12a8b3c84855336f0390fc818353fd049a2cb6","observation_id":"22fa719a-227b-4dfd-9a5a-2c7acaaf6b93","resolution":{"observed_at":"2026-08-07T15:35:45.029617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.013536Z","title":"Bran, Sam Cox, Oliver Schilter, Carlo Baldassari, Andrew D White, and Philippe Schwaller","venue":null,"work_id":"2e297f4f-2a5b-4b4d-8076-9509ec2d742a","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.202006Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:c6dd2176bf2b58299140306f2a7d62d5d4da971891a9515b1614e8510ac8d59c","observation_id":"818de6a1-ae14-483f-bbc2-8d6a5fbedddc","resolution":{"observed_at":"2026-08-07T15:35:45.017323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:45.001434Z","title":"Think-on-graph 2.0: Deep and interpretable large language model reasoning with knowledge graph-guided retrieval","venue":null,"work_id":"f66b7069-e253-43a8-a7b3-ee206ae10fe1","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.205450Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:aa8310e9f70c30ee1e67c47bfcdcddd931ae1f40c2331c1f542699a6df3061a9","observation_id":"380e70f7-1d1a-4986-974f-11593da7ecb7","resolution":{"observed_at":"2026-08-07T15:35:45.005412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.989370Z","title":"Explainable ai is dead, long live explainable ai! hypothesis-driven decision support using evaluative ai","venue":null,"work_id":"3cdd900e-98bc-437f-9334-64ce0254bf75","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.208976Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:1a056ee4cf70c566001ec5f28eb0bc7a2f0e63b5c20d035a4176b518e2b18d72","observation_id":"d03f8af5-cd5b-43c4-b2cd-eed17ec8cbd8","resolution":{"observed_at":"2026-08-07T15:35:44.993238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04348","last_updated":"2023-11-07T21:09:57Z","snapshot_observed_at":"2026-07-06T16:44:27.404644Z","submitted_at":"2023-11-07T21:09:57Z","title":"Evaluating the Effectiveness of Retrieval-Augmented Large Language Models in Scientific Document Reasoning","version":1},"cited_work":{"arxiv_id":"2311.04348","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.04348","snapshot_observed_at":"2026-08-07T15:35:44.562306Z","title":"Evaluating the Effectiveness of Retrieval-Augmented Large Language Models in Scientific Document Reasoning","venue":"cs.CL","work_id":"ca00bee4-78c3-427a-ac39-935095f32b48","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.212531Z"},"links":{"cited_paper":"/paper/2311.04348","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:b997ab6fa32c5e84284e32935fc978d7a72bc77c4a88478ed4bc5aa325e3b797","observation_id":"64981239-ccbe-4341-b08d-2e7cd7eb267c","resolution":{"observed_at":"2026-08-07T15:35:44.566829Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.976262Z","title":"A review of relational machine learning for knowledge graphs","venue":null,"work_id":"04b9b928-59ca-493b-a7cc-c8e205290c9c","year":2015},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.216249Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:67687bbd2d0ea888ab17874b410baeaec9401e47c43c9a67be3259cbdea0f29c","observation_id":"834501c2-8c27-4588-ac62-e064f7f20e9a","resolution":{"observed_at":"2026-08-07T15:35:44.981066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.962976Z","title":"Can chatgpt be used to generate scientific hypotheses? Journal of Materiomics , 10(3):578--584, 2024","venue":null,"work_id":"978c843a-822b-4317-b31f-4006960c5de3","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.219755Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:43896b485b22eca8695bd4c562a56f7febb33775f97766bbcad1a7318bcb9ab5","observation_id":"57c4f35d-7d46-41a5-9edf-ae47dc2b0b8c","resolution":{"observed_at":"2026-08-07T15:35:44.967649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08921","last_updated":"2024-09-10T15:38:56Z","snapshot_observed_at":"2026-07-06T19:01:41.274385Z","submitted_at":"2024-08-15T12:20:24Z","title":"Graph Retrieval-Augmented Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08921","snapshot_observed_at":"2026-08-07T15:35:44.223554Z","title":"Graph retrieval-augmented generation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.223554Z"},"links":{"cited_paper":"/paper/2408.08921","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:3add8a8f153f97fa039553cb7c011281859946db9ead063c2f3d9fcb550649d3","observation_id":"060dc8bf-12ba-44c0-b17a-46f5cf51c4b6","resolution":{"observed_at":"2026-08-07T15:35:44.223554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05965","last_updated":"2023-11-10T10:03:49Z","snapshot_observed_at":"2026-07-06T16:45:40.019771Z","submitted_at":"2023-11-10T10:03:49Z","title":"Large Language Models are Zero Shot Hypothesis Proposers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05965","snapshot_observed_at":"2026-08-07T15:35:44.227331Z","title":"Large language models are zero shot hypothesis proposers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.227331Z"},"links":{"cited_paper":"/paper/2311.05965","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:70e887df812e8efe46e0ba824839664299a042a4bde79f962eb02bcc6a57b974","observation_id":"78f50942-e345-4819-8346-23cc13c1cc7c","resolution":{"observed_at":"2026-08-07T15:35:44.227331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.950065Z","title":"Large language models as biomedical hypothesis generators: A comprehensive evaluation","venue":null,"work_id":"032c7089-64e5-4c4f-9a57-b39d3ce0abe4","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.230991Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:a0827aaa82b7730c939965f4e26e406ce69027e4fbfee45197aff8deb4af788d","observation_id":"81fd97d5-92ed-4bec-94cb-3c4fae8e3f0f","resolution":{"observed_at":"2026-08-07T15:35:44.953922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14634","last_updated":"2026-05-16T16:23:07Z","snapshot_observed_at":"2026-07-06T19:19:37.350445Z","submitted_at":"2024-09-23T00:09:34Z","title":"Human-LLM Compound System for Scientific Ideation through Facet Recombination and Novelty Evaluation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14634","snapshot_observed_at":"2026-08-07T15:35:44.234504Z","title":"Scideator: Human-llm scientific idea generation grounded in research-paper facet recombination","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.234504Z"},"links":{"cited_paper":"/paper/2409.14634","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:d50ab9bdb2d407da48cf6b98d42861e92c5e1dfe70a3b32928d65a7c67725f0f","observation_id":"1534be72-5362-4fda-be8a-38b4207115f9","resolution":{"observed_at":"2026-08-07T15:35:44.234504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.936902Z","title":"A review on large language models: Architectures, applications, taxonomies, open issues and challenges","venue":null,"work_id":"bd9f5f72-7644-4bd1-a536-ecaf8c9fefe7","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.238181Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:3480258cac7140e78b6a3e507e83b609a9d3983e18e714c15e335abcebbf2b6d","observation_id":"33beb8a4-b280-4b9e-8697-6ddda6f0e9d1","resolution":{"observed_at":"2026-08-07T15:35:44.941574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.924118Z","title":"The probabilistic relevance framework: Bm25 and beyond","venue":null,"work_id":"4d1430cf-dc4c-4779-ac31-6f9e533d1c71","year":2009},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.241541Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:62c32156179ee24d8f49f649a0fcfde4b12adf50f31869cb0dd1649772e10000","observation_id":"a61408ac-1252-401d-9686-7f6bad901554","resolution":{"observed_at":"2026-08-07T15:35:44.928045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07311","last_updated":"2025-06-16T02:37:13Z","snapshot_observed_at":"2026-07-06T17:43:01.800352Z","submitted_at":"2024-03-12T04:47:29Z","title":"Knowledge Graph Large Language Model (KG-LLM) for Link Prediction","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07311","snapshot_observed_at":"2026-08-07T15:35:44.244864Z","title":"Knowledge graph large language model (kg-llm) for link prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.244864Z"},"links":{"cited_paper":"/paper/2403.07311","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:7c2682a06d1737552b3867b7d0495bbd79ee19f7a649d60cbb23fdd32d066c2e","observation_id":"e67400fa-6fdd-4b6c-929c-c5fbb44557c1","resolution":{"observed_at":"2026-08-07T15:35:44.244864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-08T00:38:42.440129Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-07T15:35:44.248638Z","title":"Can llms generate novel research ideas? a large-scale human study with 100+ nlp researchers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.248638Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:45dad9b33320ae7d4dea15e24c7bffa49102277eecc73afdffdc759d9268ef33","observation_id":"f52cadca-fd1e-43a3-9402-851ebec90d94","resolution":{"observed_at":"2026-08-07T15:35:44.248638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.911350Z","title":"Colidr: Concept learning using aggregated disentangled representations","venue":null,"work_id":"a72cee34-0e9f-41f8-9ddc-d2b4c6bca876","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.252434Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:88b64e8c9d17410eac43e6f685e8d70cf7b302025ed73909618b197e22fc2b1c","observation_id":"b9295f60-5ccf-4673-a227-772be0e047a6","resolution":{"observed_at":"2026-08-07T15:35:44.915303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.898156Z","title":"A self-explaining neural architecture for generalizable concept learning","venue":null,"work_id":"662af41c-1d33-46e9-8592-b398065b7ca9","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.255801Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:c464aabd86d2c2182a80e57ace8be7b3e15ba4217d8421a286dd1da6557fede6","observation_id":"fa061371-de2f-413d-83fa-dfa00be4ecdd","resolution":{"observed_at":"2026-08-07T15:35:44.902142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13740","last_updated":"2024-09-26T15:27:08Z","snapshot_observed_at":"2026-08-08T08:44:06.036202Z","submitted_at":"2024-09-10T16:37:58Z","title":"Language agents achieve superhuman synthesis of scientific knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13740","snapshot_observed_at":"2026-08-07T15:35:44.259538Z","title":"Language agents achieve superhuman synthesis of scientific knowledge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.259538Z"},"links":{"cited_paper":"/paper/2409.13740","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:64d5fc06679fda5624ff3e0a5ac03162c0e04dd771a91bc111a58b7519af2b58","observation_id":"f8496503-a5ca-408d-b310-6e7bcb19d0a2","resolution":{"observed_at":"2026-08-07T15:35:44.259538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T15:35:44.263315Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.263315Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:81ca4039155de1fe188a4b2a8285a469304dd03f2d9fd2d1fea164349fc9ebe3","observation_id":"7663d7d0-ddcd-4e91-921a-6d0bdf53a7c0","resolution":{"observed_at":"2026-08-07T15:35:44.263315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14259","last_updated":"2024-06-03T21:15:28Z","snapshot_observed_at":"2026-07-06T15:31:41.985646Z","submitted_at":"2023-05-23T17:12:08Z","title":"SciMON: Scientific Inspiration Machines Optimized for Novelty","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14259","snapshot_observed_at":"2026-08-07T15:35:44.267051Z","title":"Scimon: Scientific inspiration machines optimized for novelty","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.267051Z"},"links":{"cited_paper":"/paper/2305.14259","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:957720b192bd5c70a2f36cd68f262feec9010af2877dbba474809b41f0ff5f85","observation_id":"557ce5cc-e533-4404-af30-2349996f2b3f","resolution":{"observed_at":"2026-08-07T15:35:44.267051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02226","last_updated":"2025-05-28T09:34:22Z","snapshot_observed_at":"2026-07-06T20:16:31.769559Z","submitted_at":"2025-01-04T08:16:23Z","title":"Knowledge Graph Retrieval-Augmented Generation for LLM-based Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02226","snapshot_observed_at":"2026-08-07T15:35:44.271010Z","title":"Knowledge graph retrieval-augmented generation for llm-based recommendation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.271010Z"},"links":{"cited_paper":"/paper/2501.02226","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:1143ebf6fee3255b546244419875578865b1d71677d7419f67a213a81c9e757d","observation_id":"2d3f3c92-ffb8-4b40-9e99-966639debedd","resolution":{"observed_at":"2026-08-07T15:35:44.271010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.274755Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.274755Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:741775425b2d0b46d25139f5c8970540ab036211cfbb0204248513ef241105c8","observation_id":"d8168298-e13f-4af9-ba2a-01d69ba1dee6","resolution":{"observed_at":"2026-08-07T15:35:44.274755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.877488Z","title":"Pubtator 3.0: an ai-powered literature resource for unlocking biomedical knowledge","venue":null,"work_id":"1d4b369f-9187-4a45-9618-a90854c5cc97","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.278183Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:83391edf52b5edd86c57a16fd80d4c2f640a9608f16b04c9d671b07fcbaf0b9e","observation_id":"d2646951-98f5-4df8-be59-cc0c32d6d9c2","resolution":{"observed_at":"2026-08-07T15:35:44.881358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12990","last_updated":"2022-03-24T11:29:20Z","snapshot_observed_at":"2026-07-06T12:51:58.757562Z","submitted_at":"2022-03-24T11:29:20Z","title":"Generating Scientific Claims for Zero-Shot Scientific Fact Checking","version":1},"cited_work":{"arxiv_id":"2203.12990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.12990","snapshot_observed_at":"2026-08-07T15:35:44.420986Z","title":"Generating Scientific Claims for Zero-Shot Scientific Fact Checking","venue":"cs.CL","work_id":"8ee911ae-3c43-43ab-87f8-6748cad78d35","year":2022},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.281944Z"},"links":{"cited_paper":"/paper/2203.12990","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:4db8c0603251c33e9a87bd0e4674e52b917b38c7a0ed6a76e47fa367cb965676","observation_id":"3910ec8a-be06-49eb-bad5-4df7c989861e","resolution":{"observed_at":"2026-08-07T15:35:44.425129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.864123Z","title":"Dynamic link prediction using graph representation learning with enhanced structure and temporal information","venue":null,"work_id":"f2e58e04-101d-4094-8fbe-e0f78dab579f","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.285609Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:dc45f4344e2fbd44b6948faa7ff57bab17853982bf771fa122a9d26c6b462eb9","observation_id":"df39b9bf-4bd9-433d-b2d7-714b21ad6694","resolution":{"observed_at":"2026-08-07T15:35:44.868411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.850003Z","title":"Benchmarking retrieval-augmented generation for medicine","venue":null,"work_id":"2d50a358-26cb-4fc4-bb59-b5e9ce749ace","year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.289178Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:32a7d39b2f58a3baadf141d2adcc1bbc3d787ceac480b083e9465d24b067ab32","observation_id":"5cc55a5d-4f8e-41f6-9ed5-a8f1c8cf6990","resolution":{"observed_at":"2026-08-07T15:35:44.854624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.836857Z","title":"Improving retrieval-augmented generation in medicine with iterative follow-up questions","venue":null,"work_id":"9a7d1ca5-1851-4e5c-90cb-483124398ee3","year":2025},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.293238Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:6f7921cb6421f494aeaa48b6cdf377060a8d4383f3ad9f5d42f63cedf3c836fc","observation_id":"09e65ccd-a000-4e53-82a3-0cf2a16c0f9f","resolution":{"observed_at":"2026-08-07T15:35:44.841311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02382","last_updated":"2024-11-04T18:50:00Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T18:50:00Z","title":"Improving Scientific Hypothesis Generation with Knowledge Grounded Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02382","snapshot_observed_at":"2026-08-07T15:35:44.296888Z","title":"Improving scientific hypothesis generation with knowledge grounded large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.296888Z"},"links":{"cited_paper":"/paper/2411.02382","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:75cec4e6db82b544fae656d5b51ad6a263ad1f915e9c8d7499b5f86196404a88","observation_id":"4567ab4b-5647-475f-9c88-b6b85dbfc96c","resolution":{"observed_at":"2026-08-07T15:35:44.296888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02726","last_updated":"2024-06-12T08:40:15Z","snapshot_observed_at":"2026-08-06T18:44:01.766609Z","submitted_at":"2023-09-06T05:19:41Z","title":"Large Language Models for Automated Open-domain Scientific Hypotheses Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02726","snapshot_observed_at":"2026-08-07T15:35:44.300728Z","title":"Large language models for automated open-domain scientific hypotheses discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.300728Z"},"links":{"cited_paper":"/paper/2309.02726","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:396cd9e529a32953cf25e8765e8ad2780c0ca2a68530037cb021c6f1284737de","observation_id":"ac650f2b-899c-4d49-a0ba-9dcbdf241ec6","resolution":{"observed_at":"2026-08-07T15:35:44.300728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.824815Z","title":"Large language models for rediscovering unseen chemistry scientific hypotheses","venue":null,"work_id":"0631ce8a-92e5-4713-a06a-cb5846b4ec31","year":2025},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.304539Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:5e03b2a0ba4b01bab5d72452d8e6485173f0de2bec0e2d1b2a2aa8374d243772","observation_id":"b892c00a-f5e6-4014-a4af-1942b5aa8c31","resolution":{"observed_at":"2026-08-07T15:35:44.828609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14647","last_updated":"2024-06-16T03:44:52Z","snapshot_observed_at":"2026-07-06T15:32:10.481273Z","submitted_at":"2023-05-24T02:33:35Z","title":"Scientific Opinion Summarization: Paper Meta-review Generation Dataset, Methods, and Evaluation","version":3},"cited_work":{"arxiv_id":"2305.14647","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14647","snapshot_observed_at":"2026-08-07T15:35:44.373331Z","title":"Scientific Opinion Summarization: Paper Meta-review Generation Dataset, Methods, and Evaluation","venue":"cs.CL","work_id":"c0a6a601-23db-4f1f-a03f-f73d87bd8a09","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.308287Z"},"links":{"cited_paper":"/paper/2305.14647","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:8e79bebbf19ed16980377d8bf63a91c347346aac529898382e28b26fdcb52142","observation_id":"c8c4d3e3-d8df-46f4-8bd0-0db061e0ce4c","resolution":{"observed_at":"2026-08-07T15:35:44.379404Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.812482Z","title":"Link prediction based on graph neural networks","venue":null,"work_id":"144d4be4-ad4e-426a-a4ad-170e77b0a6db","year":2018},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.312383Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:df243d4742d91b0118561259021a7e3f59d17af9ad82b191dd51723d2f039be3","observation_id":"55e1809b-e6eb-4843-b4e9-b048cf3c4d79","resolution":{"observed_at":"2026-08-07T15:35:44.816240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.799769Z","title":"Goal driven discovery of distributional differences via language descriptions","venue":null,"work_id":"250dd12b-dbf6-472c-831f-ee3868d3c9ed","year":2023},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.316068Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:6e637ec6acc2a8372e49aeec57eef684e99bb18aa155860ed88dd269c0af4efe","observation_id":"342c9668-7aaf-4f82-8ce1-61aa02e612b4","resolution":{"observed_at":"2026-08-07T15:35:44.803688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04326","last_updated":"2024-12-18T19:00:00Z","snapshot_observed_at":"2026-07-06T17:56:18.931340Z","submitted_at":"2024-04-05T18:00:07Z","title":"Hypothesis Generation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04326","snapshot_observed_at":"2026-08-07T15:35:44.319549Z","title":"Hypothesis generation with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.319549Z"},"links":{"cited_paper":"/paper/2404.04326","citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:8f5ab2b7a2771b223c4feffa7e243effa968a064e395f0ec2a25177c6144e3c3","observation_id":"dcecd143-52f7-4e3a-8f13-682e8c310db2","resolution":{"observed_at":"2026-08-07T15:35:44.319549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:44.323361Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T15:35:44.323361Z"},"links":{"citing_paper":"/paper/2505.14599"},"observation_digest":"sha256:8be04e405a81779c1be1fcb6db635ae8a305e3ce38536bb0ccb07f401225bf07","observation_id":"92ce117e-cd9d-49aa-9c94-6730d710cb2e","resolution":{"observed_at":"2026-08-07T15:35:44.323361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14599","last_updated":"2025-06-08T22:42:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:29:26.474390Z","submitted_at":"2025-05-20T16:49:40Z","title":"Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":6,"verified_fuzzy":28},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 2 inbound Pith citation observations for arXiv:2505.14599."}