{"as_of":"2026-08-18T19:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9859c68a26eed5641ffda050621a69317c6970fbfe4a8124fb57ae3b8a951d1","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T05:39:35.951893Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22781/citation-record","integrity":"/paper/2607.22781/integrity","json":"/paper/2607.22781/citation-record.json","paper":"/paper/2607.22781"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:33.820553Z","title":"Towards better evaluation for dynamic link prediction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:33.820553Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:7a633103a3cacebb24b28fad48c7957300eecde3411a4645106d96f049a2feb8","observation_id":"66ce7296-48d5-4907-b5d9-fcfd4553a097","resolution":{"observed_at":"2026-08-01T05:39:33.820553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:33.939390Z","title":"On the power of heuristics in temporal graphs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:33.939390Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:ac715ff80ea5c11822dcd859a4db8e487b8d97c94e9e81058e030e8d28c13285","observation_id":"8e80074f-d751-4182-903b-f66c91e7ae39","resolution":{"observed_at":"2026-08-01T05:39:33.939390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.09416","last_updated":"2026-07-15T15:14:01Z","snapshot_observed_at":"2026-08-14T21:46:52.445118Z","submitted_at":"2025-10-10T14:18:37Z","title":"What Do Temporal Graph Learning Models Learn?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.09416","snapshot_observed_at":"2026-08-01T05:39:34.042152Z","title":"What do temporal graph learning models learn?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.042152Z"},"links":{"cited_paper":"/paper/2510.09416","citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:d26109fabe541cb081505fe34411c5d684bf1a6cb1c0dfdadc97dbdb2793749b","observation_id":"3a0fad89-0582-4806-88ab-9fc9d9bb689e","resolution":{"observed_at":"2026-08-01T05:39:34.042152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.138511Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.138511Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:0d02969b95b6d8635a4843bc39d41c1c44b8bccbd33a3c25d22a328dcbad799e","observation_id":"13c49549-6612-431d-8aae-0495e29a1e0c","resolution":{"observed_at":"2026-08-01T05:39:34.138511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.233655Z","title":"Inductive representation learning on temporal graphs,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.233655Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:87c61fbedbf1f9cb0fe411d0fdd8e4acb53cc57d4daf2529c3a8faf1c78f568a","observation_id":"ab6c9d43-5310-4451-b516-7c5aa949f8e7","resolution":{"observed_at":"2026-08-01T05:39:34.233655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.382237Z","title":"Do we really need complicated model architectures for temporal networks?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.382237Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:b7d3b3f2f97c5b266be6af2eb275626ab596e53428b8abbb6c5ba3da2c41fa94","observation_id":"e175949c-a8dc-48ca-aa70-8379523152b5","resolution":{"observed_at":"2026-08-01T05:39:34.382237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.498541Z","title":"Towards better dynamic graph learning: New architecture and unified library,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.498541Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:459a8be67a73ab606ac567c016bde8f98338df8ca87c4b2c19260c35476302f6","observation_id":"47b34c7c-eea1-423e-86d7-67b0c1adda22","resolution":{"observed_at":"2026-08-01T05:39:34.498541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.596551Z","title":"Future link prediction without memory or aggregation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.596551Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:631b317ae1256eb4e8c10f7b77d418f285a88ebf97729431688ac50327f87db3","observation_id":"c72fc159-4473-4c7f-b25f-98de02588dac","resolution":{"observed_at":"2026-08-01T05:39:34.596551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.651439Z","title":"Understanding intermediate layers using linear classifier probes,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.651439Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:3648cf91b2d0cea999b73354bfafea0c5c2bebbdafcb0994cb7ad11b087cdf72","observation_id":"21b86f7e-e0f7-4d46-acdd-e86d2bf68555","resolution":{"observed_at":"2026-08-01T05:39:34.651439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.688564Z","title":"What you can cram into a single $&!#* vector: Probing sentence embeddings for linguistic properties,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.688564Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:495c14b25374a3622ca1e49c3644496c6c005b141d51c4efbbe09b551d44c903","observation_id":"66f88b78-3841-40b2-8794-87acbfc9121e","resolution":{"observed_at":"2026-08-01T05:39:34.688564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.761679Z","title":"Designing and interpreting probes with control tasks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.761679Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:e615c15cd2391567e547bdc5640a57a1eaf9154001c363a3038af5c8daf1ab7e","observation_id":"c45d3e01-2531-4459-ad54-76ab4f64fecf","resolution":{"observed_at":"2026-08-01T05:39:34.761679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.837093Z","title":"Classifier probes may just learn from linear context features,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.837093Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:cbc62f7641304155746a44efffeb9e05ab493f90e7fc7dcf02f056e1b84f567e","observation_id":"7bd7ee1f-7a42-4c6a-b852-acdf0b990dfa","resolution":{"observed_at":"2026-08-01T05:39:34.837093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:34.895138Z","title":"Improving attention mechanism in graph neural networks via cardinality preservation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.895138Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:3200055d1b6ffe7308d1e536d578d684e25b3d870c230fc8fb9d79ca1f34c0f8","observation_id":"e168b132-b4e2-4668-95c2-ec243bc7e9ba","resolution":{"observed_at":"2026-08-01T05:39:34.895138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.09561","last_updated":"2020-05-19T16:26:34Z","snapshot_observed_at":"2026-08-18T15:30:52.211739Z","submitted_at":"2020-05-19T16:26:34Z","title":"Normalized Attention Without Probability Cage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.09561","snapshot_observed_at":"2026-08-01T05:39:34.962313Z","title":"Normalized attention without probability cage,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:34.962313Z"},"links":{"cited_paper":"/paper/2005.09561","citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:d8629646233c842a3b306b295dfbedb4df1280e7c71c93998f2fedccad16f9a7","observation_id":"8eb7ee61-7303-439d-80e1-a089b80a1a5a","resolution":{"observed_at":"2026-08-01T05:39:34.962313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.037023Z","title":"Affine-scaled attention: Towards flexible and stable transformer attention,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.037023Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:3596ec6fbb636cf7bb6cebbb53abf13d378da0ffde2eaebcccd4453a6801757e","observation_id":"28f99b3d-fec4-40ae-bd6a-05332f0a9df0","resolution":{"observed_at":"2026-08-01T05:39:35.037023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.096080Z","title":"Recurrent marked temporal point processes: Embedding event history to vector,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.096080Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:5a1f38f739245fc69f7704156c8ab9d4b7fe9affd8b69168fcda84cb7e484ce0","observation_id":"9200dc49-65ad-4894-a594-ab2d6a70df54","resolution":{"observed_at":"2026-08-01T05:39:35.096080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.156189Z","title":"The neural hawkes process: A neurally self-modulating multivariate point process,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.156189Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:9d1e89eebad39b69e61a510c425b114733e99bc838a8ed30962174bc6e51d5db","observation_id":"1b06fcfd-e017-4227-b045-6e8ee2a15614","resolution":{"observed_at":"2026-08-01T05:39:35.156189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.223400Z","title":"Transformer hawkes process,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.223400Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:7d30c682de635312701edbe28b64f680cdd7bd4dda9aa35b93d542f4a077ba1c","observation_id":"ed51425e-868a-48bb-b3b8-caeaea9b3232","resolution":{"observed_at":"2026-08-01T05:39:35.223400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.283265Z","title":"Transformer embeddings of irregularly spaced events and their participants,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.283265Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:6f95ceb1cc4c08a0daaf35af2888867fe91977ee199b8f0550c2edd3f487038d","observation_id":"01195efa-551c-4ea1-9664-b0742d8fa90b","resolution":{"observed_at":"2026-08-01T05:39:35.283265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.361788Z","title":"Recurrent event network: Au- toregressive structure inference over temporal knowledge graphs,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.361788Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:356de6db23b25f3af2a8a067c772a7ada9e8866285aaa94c625562da7924faf6","observation_id":"0fd3b95b-d7b4-40d7-b5ec-40d01ba0121f","resolution":{"observed_at":"2026-08-01T05:39:35.361788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.417598Z","title":"Explainable subgraph reasoning for forecasting on temporal knowledge graphs,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.417598Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:e2c3cc30b8473b62ee2f41b5b43edc4ed47b94e9abbb7e31026ed5076d83c750","observation_id":"ed3b383c-f6dc-4e28-a810-1c939d94b6d3","resolution":{"observed_at":"2026-08-01T05:39:35.417598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.463758Z","title":"Learning from history: Modeling temporal knowledge graphs with sequential copy-generation networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.463758Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:87eafc9c4086bdcf3687d02baad8d2db3843ac2bc843faea4c220c6135ca7530","observation_id":"804164d1-ffb0-4ff1-ae71-192ea488ae53","resolution":{"observed_at":"2026-08-01T05:39:35.463758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.521219Z","title":"HotpotQA: A dataset for diverse, explainable multi-hop question answering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.521219Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:935a564f76fed327f0c2656eca3aebda19eff9a2c6c12b28236ea08861026790","observation_id":"81002c6c-96a9-4357-bbba-81f98a245bc2","resolution":{"observed_at":"2026-08-01T05:39:35.521219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.574264Z","title":"Leveraging passage retrieval with generative models for open domain question answering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.574264Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:3552cc6b01c72c19371ffb943eb2a2085fe11015fc38f1066745366fb1dd4e7d","observation_id":"1c94e930-95ac-42ce-960a-b318836c0651","resolution":{"observed_at":"2026-08-01T05:39:35.574264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.619144Z","title":"Neural spatio-temporal point processes,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.619144Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:7f2cfd4482727fc22020217c2bd018ab9aeb73abefb4b5d2034397670acf9a3b","observation_id":"852c2187-1cd6-446b-b778-915738720ee2","resolution":{"observed_at":"2026-08-01T05:39:35.619144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.676829Z","title":"Neural point process for learning spatiotemporal event dynamics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.676829Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:da5a4c090c773727047a4381c0e32374ed1a36863611331e889975d61616ea38","observation_id":"28416329-bbd6-4ca6-a794-b54e7690f821","resolution":{"observed_at":"2026-08-01T05:39:35.676829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-01T05:39:35.729716Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.729716Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:04e09e90c857d4020cfd10c1cb6e303320922e2189b8b24151d1751678304062","observation_id":"8d92e767-3cff-4888-a397-5350d588534b","resolution":{"observed_at":"2026-08-01T05:39:35.729716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.799911Z","title":"On layer normalization in the transformer architecture,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.799911Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:871f0c36ff308ac2303cdea6141ae41fc2363253473f9efe5bb04d9f8fc662b4","observation_id":"1ef1cb86-ce00-4154-8d9d-b5a09869fba9","resolution":{"observed_at":"2026-08-01T05:39:35.799911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.868105Z","title":"Predicting dynamic embed- ding trajectory in temporal interaction networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.868105Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:a9f9ed529d8e8636cdfb0b0ae897f7572c3ee78cebdd63259240ad3729aec17b","observation_id":"3eb3b75c-c788-4900-b1c1-c44bbb118ebd","resolution":{"observed_at":"2026-08-01T05:39:35.868105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:39:35.951893Z","title":"Emergence of scaling in random networks,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T05:39:35.951893Z"},"links":{"citing_paper":"/paper/2607.22781"},"observation_digest":"sha256:b15834bdbc5c954f33b94c90045fd111308f72d1dcce0f333507326541191583","observation_id":"6193663a-f897-475d-aa67-33444527a7a4","resolution":{"observed_at":"2026-08-01T05:39:35.951893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22781","last_updated":"2026-07-24T10:11:22Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T15:21:20.393301Z","submitted_at":"2026-07-24T10:11:22Z","title":"What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2607.22781."}