{"as_of":"2026-08-17T13:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf570675f9c5588e9fead264a0b85e3e2624780f4344adad09a309e0fc543e23","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:42:04.013182Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23942/citation-record","integrity":"/paper/2505.23942/integrity","json":"/paper/2505.23942/citation-record.json","paper":"/paper/2505.23942"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.121727Z","title":"The generalized sigmoid activation function: Competitive supervised learning","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.121727Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:c149f80a8944efa15c376c79d80da876deb6eb724fbc049d94929b3eab429bbe","observation_id":"df87988c-144e-4890-a05c-9c82425d618b","resolution":{"observed_at":"2026-08-07T12:42:02.121727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.182353Z","title":"LeCun, L \\'e on Bottou, Genevieve B","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.182353Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:9bcb132c58b8197b1d138422e941af45f8a3a05a1f5b97d4c86de784601e52d1","observation_id":"91ac5d94-3e34-463e-8c85-9f9b88fd88a6","resolution":{"observed_at":"2026-08-07T12:42:02.182353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.784242Z","title":null,"venue":null,"work_id":"3061acca-a8a0-4014-a283-b935c6e63927","year":2010},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.273009Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:df52e61577a766c271b893e4d8e3d51665f6b2205bdd2cc9ff687d218ea0ff9f","observation_id":"7ba49c52-daeb-4b62-8940-320a9349bc40","resolution":{"observed_at":"2026-08-07T12:42:05.822536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.590183Z","title":null,"venue":null,"work_id":"4e3eaf4b-787d-44b0-863c-271db8b7057d","year":2018},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.341057Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:b7dc20276defe9f63e2268b91de720dfa44b0de966448a183ea11a159e4553eb","observation_id":"49609d34-7153-4723-b0ea-b60a76983cc1","resolution":{"observed_at":"2026-08-07T12:42:05.679909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.458706Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":"08f1953e-f797-4f27-9b61-75b98cf182db","year":2016},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.456841Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:98c9b5718eb487f6577e8a0a203861bcec3fe37c24e2ae5e06a9130ce23d7388","observation_id":"5bbd54c8-e567-4f12-9aea-7bd02f5a2e15","resolution":{"observed_at":"2026-08-07T12:42:05.501003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.394801Z","title":"E fficient N et: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":"25de0cb9-9d90-4bf8-8608-0ed47aadd9d0","year":2019},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.557942Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:ec9903a77dda3ae3be0147e9558af756ecec4a99b19541e513d970e295934bd0","observation_id":"c035c418-9142-4685-a091-68da37bcb363","resolution":{"observed_at":"2026-08-07T12:42:05.449194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-17T01:19:18.409791Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-07T12:42:02.655820Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.655820Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:5142c97c2140e6297df4707c82b421d2c61d189bb38a4926c58083efafbf236b","observation_id":"3412cf3a-d44e-4135-a238-e1c2a0d7583f","resolution":{"observed_at":"2026-08-07T12:42:02.655820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.258136Z","title":"Learning Multiple Layers of Features from Tiny Images , 1 2009","venue":null,"work_id":"e4c4fc3d-0e2b-4a68-90cd-0c2fa7d805d1","year":2009},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.742196Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:534ec6b540c11c320eb90e5c6298937a94772edc617362cd2f572ff15184e81f","observation_id":"51f37ccd-b75b-4a4f-8d93-b134d51fe8c0","resolution":{"observed_at":"2026-08-07T12:42:05.320678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.135438Z","title":"Maas, Raymond E","venue":null,"work_id":"3a15bb06-9e3e-4c60-a7d3-77998b285a70","year":2011},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.851085Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:5716f27c2857e09bdb103754d036ce19752645d87113b7f5715b04a54c351086","observation_id":"cef43ca7-c1db-4f93-8b3c-35b4285707d2","resolution":{"observed_at":"2026-08-07T12:42:05.180122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.015435Z","title":"Findings of the 2014 workshop on statistical machine translation","venue":null,"work_id":"c1ef93bd-2e48-4338-a929-062add217a71","year":2014},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:02.928138Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:d1eca3beb99370eb30a99e202040149672c94a0391626a7e45dff666bff2b681","observation_id":"05e0c8a7-75f1-4fa5-905d-e5eca1cfe0ae","resolution":{"observed_at":"2026-08-07T12:42:05.086755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.012124Z","title":"Deep Residual Learning for Image Recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.012124Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:1bb574546e587efcac99ecd2c8b99dee498860895dbf85f3ada5fe8240607804","observation_id":"0d535201-72fa-42d1-a311-809f4b588208","resolution":{"observed_at":"2026-08-07T12:42:03.012124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.110775Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.110775Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:ac6ab440c1b6139f6fc103e15a2b9813d70938952e3f819eeabe06fcb7b8fc62","observation_id":"2409fec4-ec93-4ba9-ba54-17e7e0c1e971","resolution":{"observed_at":"2026-08-07T12:42:03.110775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.179099Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.179099Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:6f43863db006b1fbc89d1f78e33d533ebf686ab7cbf95efbf2580974cf48b4b4","observation_id":"ec0377f5-9eca-4f40-a175-605b920e2ae4","resolution":{"observed_at":"2026-08-07T12:42:03.179099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-84186-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"A Robustly Optimized BERT Pre-training Approach with Post-training","venue":"Lecture notes in computer science","work_id":"0a7fb62f-c40e-4b56-95ce-edf667b1aaea","year":2021},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.288228Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:d290200a76e05965bee87ec096b6ad644eaca4d92ecb40fc728c4b9d8c809f8e","observation_id":"3cb5d3d9-d5b2-4e20-9b9c-70f4dfdf90e5","resolution":{"observed_at":"2026-08-07T12:42:04.143622Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-07T12:42:03.381498Z","title":"Yang, Zachary DeVito, Martin Raison, Alykhan Tejani, Sasank Chilamkurthy, Benoit Steiner, Lu Fang, Junjie Bai, and Soumith Chintala","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.381498Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:8365a48c25098e2f7f49d0e7bea1f119fa51c30144c2a3a02bb030986e9fef85","observation_id":"cc7ad223-005a-4f3a-a7db-8718d0e91eed","resolution":{"observed_at":"2026-08-07T12:42:03.381498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6877.30268","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.329969Z","title":"Murray, Benoit Steiner, Paul Tucker, Vijay Vasudevan, Pete Warden, Martin Wicke, Yuan Yu, and Xiaoqiang Zheng","venue":null,"work_id":"021e3221-b297-459b-b13b-621204117d09","year":2016},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.452418Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:5e8d44ab9dc990e3b88d96f6b0d3a2cd9f5a34bada5ec3360073bffec414a1dc","observation_id":"022fa4f3-d6a5-45fe-8771-cec103757ca0","resolution":{"observed_at":"2026-08-07T12:42:04.392172Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08681","last_updated":"2020-08-13T05:42:12Z","snapshot_observed_at":"2026-08-15T11:10:42.406459Z","submitted_at":"2019-08-23T06:22:06Z","title":"Mish: A Self Regularized Non-Monotonic Activation Function","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08681","snapshot_observed_at":"2026-08-07T12:42:03.531466Z","title":"Mish: A self regularized non-monotonic neural activation function","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.531466Z"},"links":{"cited_paper":"/paper/1908.08681","citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:bd4f50052a0ec958efe914eecc9b53b8b0dd724dfdda2071ee7a1058bdfd1ba2","observation_id":"1e33387b-a5cd-4fe0-8ccc-6ff22f0ce5a7","resolution":{"observed_at":"2026-08-07T12:42:03.531466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-15T03:49:17.013617Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-07T12:42:03.624328Z","title":"An overview of gradient descent optimization algorithms","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.624328Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:95f0b84768e66b4d98378b8b6f8546b97d38ff55454f73eb3c1fded282fb23b3","observation_id":"16e93cfb-354f-41dd-baf1-82cbb7035824","resolution":{"observed_at":"2026-08-07T12:42:03.624328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.795643Z","title":"Maas, Raymond E","venue":null,"work_id":"9d5fefb8-6f67-495a-aec7-533fb672defe","year":2011},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.718035Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:98293b447cedaf9b450ddd0c7545238b4c90e9cd48cd974b6b00bb5df72d9158","observation_id":"39de25c3-c34e-47f7-8ce1-91d5217d2e51","resolution":{"observed_at":"2026-08-07T12:42:04.873770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T12:42:03.788527Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.788527Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:1cb95e0d7384710da5345f20704f8689fa344b6d299a3dd19d842d921f44796e","observation_id":"4d575e59-e978-4c88-8cd0-e6585c999ee6","resolution":{"observed_at":"2026-08-07T12:42:03.788527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.667391Z","title":null,"venue":null,"work_id":"80670b5b-f72b-4895-a0ef-982c3c0ed1ba","year":2013},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.847087Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:f5f8ea2b3faa761b5bbb19037f8db60a205912effaab99527d18a34b25fd6008","observation_id":"3426d83b-7592-48ea-813d-05f87c55fb01","resolution":{"observed_at":"2026-08-07T12:42:04.721925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.899104Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.899104Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:fd570b7f15a59b1547e66f0b8db15fdec0d29e5404b2234e6b95ce849427b2fa","observation_id":"cf7e89c4-6cb3-437a-8731-d3f1a3712259","resolution":{"observed_at":"2026-08-07T12:42:03.899104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.956037Z","title":"Activation functions in deep learning: A comprehensive survey and benchmark","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:03.956037Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:97b43c57868ea7fdc85aee18fdc10a86e164246936eb83f09ffdbee2d557fc75","observation_id":"ed692a4c-9576-469b-80fd-a87fa58a2d89","resolution":{"observed_at":"2026-08-07T12:42:03.956037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.552557Z","title":"Adaptive parametric activation","venue":null,"work_id":"3cc00d41-f983-4a32-b6a0-d2365da8606b","year":2024},"citing_paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:04.013182Z"},"links":{"citing_paper":"/paper/2505.23942"},"observation_digest":"sha256:09b2e5a9633b8053305a349682e2ac9a06a5c028a9a409e806fb072765c86724","observation_id":"af4e0f2b-7617-44ca-8cf0-973e8dab0a81","resolution":{"observed_at":"2026-08-07T12:42:04.587498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23942","last_updated":"2025-05-29T18:48:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T14:45:39.133727Z","submitted_at":"2025-05-29T18:48:18Z","title":"SG-Blend: Learning an Interpolation Between Improved Swish and GELU for Robust Neural Representations"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2505.23942."}