{"as_of":"2026-08-10T17:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a545844fac2f4e343317427259253269022daa50855a35daf4952e1474f1d037","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:09:07.114453Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T20:30:30.157388Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11778","snapshot_observed_at":"2026-08-01T20:30:30.157388Z","title":"arXiv preprint arXiv:2604.11778 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16609","last_updated":"2026-07-18T03:08:31Z","snapshot_observed_at":"2026-08-08T08:49:46.366509Z","submitted_at":"2026-07-18T03:08:31Z","title":"Can Multimodal Large Language Models Understand OCT?","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T20:30:30.157388Z"},"links":{"cited_paper":"/paper/2604.11778","citing_paper":"/paper/2607.16609"},"observation_digest":"sha256:ff52b54282d7ccb5d467a1e2a7f49a1af5f673890bbddac043efb1796f6353e9","observation_id":"74d7ed9f-5789-4051-814c-4d32f6439cff","resolution":{"observed_at":"2026-08-01T20:30:30.157388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"cited_work":{"arxiv_id":"2604.11778","doi":"10.48550/arxiv.2604.11778","metadata_source":"pith","pith_arxiv_id":"2604.11778","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","venue":"cs.CL","work_id":"35c34246-00d8-4855-b3b5-e06b89d952bb","year":2026},"citing_paper":{"arxiv_id":"2607.25675","last_updated":"2026-07-28T12:53:30Z","snapshot_observed_at":"2026-08-08T21:13:41.515747Z","submitted_at":"2026-07-28T12:53:30Z","title":"DecoEvo: Score-Decoupled Co-Evolution of Solver and Rubric-Generator Skills in Text Space","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:54:10.297931Z"},"links":{"cited_paper":"/paper/2604.11778","citing_paper":"/paper/2607.25675"},"observation_digest":"sha256:dcbed447119333a39d6bcfb3432c9f58e2729f0498bbb01edb5d7426a8754813","observation_id":"3cd5a9ed-3e9b-44bb-8875-079919e4b148","resolution":{"observed_at":"2026-08-01T01:56:12.212710Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11778","snapshot_observed_at":"2026-07-31T19:49:39.646529Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28037","last_updated":"2026-07-30T11:18:47Z","snapshot_observed_at":"2026-08-10T16:52:16.063664Z","submitted_at":"2026-07-30T11:18:47Z","title":"ClawTrack: Towards Trace-Level Evaluation and Improvement of Real-World Autonomous Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T19:49:39.646529Z"},"links":{"cited_paper":"/paper/2604.11778","citing_paper":"/paper/2607.28037"},"observation_digest":"sha256:638909c0752369d6c74591967c7281526151d6b44d8fb444f8ab58b1a6f38181","observation_id":"60424a0e-76ca-48fd-aae6-0c05591112d9","resolution":{"observed_at":"2026-07-31T19:49:39.646529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.11778/citation-record","integrity":"/paper/2604.11778/integrity","json":"/paper/2604.11778/citation-record.json","paper":"/paper/2604.11778"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"95da0e62-49fe-41ce-b5d4-3cad29efef94","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:ae43e3e339aa0733bbb9e210d976a8a0fe5183f473d236f5a7cb1fbcb690e5f6","observation_id":"5f231b57-86a5-48fe-b968-864e781eff5d","resolution":{"observed_at":"2026-05-17T16:50:00.054632Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"02d49219-ca22-4d5e-975e-5a88ff4614f7","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:082da7938339fcfdea19163dfc609d6d9cf52c4a924817466656c6258fced4b7","observation_id":"60a60b64-f0d0-476d-9f80-f6ef5588bc30","resolution":{"observed_at":"2026-05-17T16:50:00.079054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8971f933-39d3-4d9c-aad9-e644fb62e1c8","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:4299dc344575510dfdfeadca647aeb42681652e3af4c739271a9152e24024062","observation_id":"99eecef3-820c-43a4-8a56-7b8031b53d8f","resolution":{"observed_at":"2026-05-17T16:50:00.051508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"53a48645-0191-4e49-9f97-9ae62999daef","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:1cc1e9eadd8fcb35eaabd75b11bc6bcf88359813c3b94482ca612bc55f2a8c76","observation_id":"30bbc333-6f03-4288-b29c-bfbf7e2d172a","resolution":{"observed_at":"2026-05-17T16:50:00.045333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"60fe3952-73b4-458e-9498-524b7f2e9649","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:13fd7a9d85bae88d1284655f31e8d105fc2b39a830863b543a79e360007ec6b7","observation_id":"3cc22ba3-1315-4e74-ab48-1d3db397cdba","resolution":{"observed_at":"2026-05-17T16:50:00.038911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc991216-12cf-4905-8e67-a49da2104f30","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:abca79918c73ac1e25647d7046b311a5d9c935675b9e7c958af9db6a0bcdce04","observation_id":"71abe3a5-efc4-4a9b-9136-6e61dd4c5832","resolution":{"observed_at":"2026-05-17T16:50:00.058078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9c7c2a06-66fc-4199-9ad3-99fde4b8e14a","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:91b1aa45a5a1ea7594dd82299a05208befb96960ba0ac52de56f16423426330d","observation_id":"26fa5e3a-8b08-436e-8a95-9af0da2adf1a","resolution":{"observed_at":"2026-05-17T16:50:00.068726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Among them, there was one person who ordered espresso","venue":null,"work_id":"a193dc16-7c13-4d63-860c-28973df08114","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:e10466d0cb2cdfb4c4e8a1e086a37c6ec0bf62c27b991dd74eb2abf7eac57c0e","observation_id":"b2e3c2d4-a7a8-40bf-b70d-176dc2684400","resolution":{"observed_at":"2026-05-17T16:50:00.061823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"00295f26-b927-4857-ab16-b791d2a4e62a","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:1931c0a98e74cb380c8a464f918c41728ab5c2f7da775ddf8229e30289b4fc6f","observation_id":"ff24f900-9379-4be2-a4a8-f91c7b9f9e25","resolution":{"observed_at":"2026-05-17T16:50:00.065573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"60668c59-75e2-40b9-b488-01fc62b1cf89","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:14f9bf72802bb177505ed124a252c031f1a58105e35ab818ebca04f74bc3ce73","observation_id":"ae159013-4ef5-432e-82f3-ef0a49b2c5f2","resolution":{"observed_at":"2026-05-17T16:50:00.042242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"96d76b98-7e35-44d1-81f1-ac7771459158","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:672f49eecf2637375215f9a6b86360671de82b9a35cd1c7eeec70d0b0d73a79e","observation_id":"d69b5c4c-9671-433e-8259-7ddcccbd900e","resolution":{"observed_at":"2026-05-17T16:50:00.082248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bef2dc4-6f2f-43bc-8a3a-7c9c50496c69","year":2070},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:141e903df9bcaceb586730d4ce50485371ed6cc5066b4ecafb367f749eca9e09","observation_id":"86a291f3-6929-4c6b-ae69-4adfeb1cbc22","resolution":{"observed_at":"2026-05-17T16:50:00.048413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb2d8069-0c30-4997-8921-31ef60cf4d1d","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:3bb67904b633deec6a92582ec5896ee384670fac2e0f66e380de9f7a13f2dd44","observation_id":"6fcd68d2-b7da-484a-a3f8-7a21107b98c8","resolution":{"observed_at":"2026-05-17T16:50:00.071733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38bb7d8c-f2d7-4e30-b0f0-e4fe039363a9","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:9957d96904a6754c7086a620c7bb44b5371dbcf615fc9d236a047b328169f063","observation_id":"cee4f2b8-0995-456d-b057-891ffbd2a569","resolution":{"observed_at":"2026-05-17T16:50:00.085456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We’ve lost a friend. The murderer is likely hiding in the crowd. Please be careful","venue":null,"work_id":"72e4de83-2139-4572-938d-020650a97401","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:d7c29f699ae7acd51103e09887e2c1a46731f9012de96324b813144413a70511","observation_id":"03374e5a-4991-441e-99a2-4c4afd0f327f","resolution":{"observed_at":"2026-05-17T16:50:00.075935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T20:32:47.592859Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":12,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 3 inbound Pith citation observations for arXiv:2604.11778."}