{"as_of":"2026-08-12T08:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f8ec9f9bb01a4cbe3cb4343c5d7808fa5b9ed9d3946f4982d4f8010d68b5ce24","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:39:13.256643Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.16423/citation-record","integrity":"/paper/2412.16423/integrity","json":"/paper/2412.16423/citation-record.json","paper":"/paper/2412.16423"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:12.967140Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.967140Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:3172178e39f40f10d09aa56f07f6ccb93122607ef139b938219cfe0dc9a84fd6","observation_id":"d1eeb4de-c2f3-4f37-86c2-c27f937f0898","resolution":{"observed_at":"2026-08-11T10:39:12.967140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.247273Z","title":"Improving language understanding by generative pre-training, 2018","venue":null,"work_id":"391bfcae-15bf-4193-bbd1-51cda9a3ed62","year":2018},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.971702Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:5a22743c32c10507310bad5c44d5d5d9afffb324b468e2632490a6f31741a4ee","observation_id":"81db22d7-d1ea-4232-b0fe-54a1b127ee97","resolution":{"observed_at":"2026-08-11T10:39:14.251515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.236332Z","title":"Language models are unsupervised multitask learners, 2019","venue":null,"work_id":"6069e514-b4f2-459f-98f2-ac0143eee8c6","year":2019},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.976067Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:cd17f07de0af7071c0b803c8cf8ea8035c50d9f0063148faf17ec9cd4612b1a5","observation_id":"4bcc0013-8f80-4ac4-aaa0-7ff8eadd77a8","resolution":{"observed_at":"2026-08-11T10:39:14.239831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T10:39:12.981104Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.981104Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:9974e8685978ed92db093c15888075ef19218b40a3f0a9d65451a3e0ca196bbb","observation_id":"0e8122a4-ab52-463d-96fc-78034520fb8d","resolution":{"observed_at":"2026-08-11T10:39:12.981104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T10:39:12.988413Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.988413Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:f5e9595dcd20fea6874b0fd34845a90f45a092efcb0b419e27688d652d0b6912","observation_id":"1d063789-c323-4e4f-a2d5-93faaa4f723e","resolution":{"observed_at":"2026-08-11T10:39:12.988413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-11T10:39:12.993326Z","title":"Scaling laws for neural language models.http://arxiv.org/abs/2001.08361, 1 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.993326Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:a5c042cfdffd34208012a4d5967b6abedf948ecc4ac9bf4d2f9eb6790308bf25","observation_id":"0b353ace-93d3-4bc9-87ac-420e32bd3c62","resolution":{"observed_at":"2026-08-11T10:39:12.993326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01169","last_updated":"2022-02-09T11:07:21Z","snapshot_observed_at":"2026-08-09T22:43:05.276517Z","submitted_at":"2022-02-02T17:58:52Z","title":"Unified Scaling Laws for Routed Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01169","snapshot_observed_at":"2026-08-11T10:39:12.997578Z","title":"Unified scaling laws for routed language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:12.997578Z"},"links":{"cited_paper":"/paper/2202.01169","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:145bf6f83a5ed53972e841b8ad4f62750a4dc7d23992386c8f1ca91cff4fa618","observation_id":"c72f57bd-4418-432c-86a4-20c1a8226200","resolution":{"observed_at":"2026-08-11T10:39:12.997578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T10:39:13.003423Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.003423Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:accc2ea903bf6c3211ee08349bb2c604f0f6bfe417dc1171fcea97d632c16e94","observation_id":"17c08c8e-5951-4a30-be33-4375da47a5c5","resolution":{"observed_at":"2026-08-11T10:39:13.003423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T10:39:13.008110Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.008110Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:21accb2ea7196db8651e2ae3287fd0c65deb31818f4d87391d9f0dcb8c34b6cc","observation_id":"4a89cac9-5775-4fd0-b8a8-2f5552578621","resolution":{"observed_at":"2026-08-11T10:39:13.008110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T10:39:13.012330Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.012330Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:c0f2c096e1ab9857c93d3c284d4807fc453c07344d63a506389be411c3d4cf99","observation_id":"7b7d298f-4615-48db-ae55-032c7754644a","resolution":{"observed_at":"2026-08-11T10:39:13.012330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-11T10:39:13.016621Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.016621Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:032eca95618de29cbf7041875df98b03737255cb2360b4fa323ce3d792cd574b","observation_id":"bc9de67c-0ff6-4f4e-8259-70c297eb1bb7","resolution":{"observed_at":"2026-08-11T10:39:13.016621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-11T10:39:13.021669Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.021669Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:768941223d83363cf40b40e78fce7103a956a17be0408497b70a591ef4efb6c6","observation_id":"4f2b2d5a-71c4-4c1d-b431-2a4303985a9c","resolution":{"observed_at":"2026-08-11T10:39:13.021669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-11T10:39:13.030085Z","title":"The falcon series of open language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.030085Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:51373d9461c966b5c5a54a5d90231c99a9a1c6afde28fdeeabd105cb85481370","observation_id":"78f1e7b1-f1bc-4b1d-a572-d78a803bb3f4","resolution":{"observed_at":"2026-08-11T10:39:13.030085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-11T10:39:13.034153Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.034153Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:b1361b251088dabd484d5b92cb27fafdec1a49f766a23d06d094728f2bed978b","observation_id":"a8dc0f50-cd08-4fa3-9869-b4b0edd4f566","resolution":{"observed_at":"2026-08-11T10:39:13.034153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T10:39:13.038403Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.038403Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:53e4252d473cb6963de380cad470bb95b9947901a677ba0a876588ef9db1f54a","observation_id":"94247994-af51-4578-8f19-cd4c4d7b4825","resolution":{"observed_at":"2026-08-11T10:39:13.038403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T10:39:13.043966Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.043966Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:771010cbde399d13ffdc07862143ae682e95ffa2a6b4a7acce7041a4211d9024","observation_id":"0a9b2815-cb2e-4997-a078-71449732d887","resolution":{"observed_at":"2026-08-11T10:39:13.043966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-11T10:39:13.048780Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.048780Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:85b5dd3a9a1546175b09ff8c42cd964b4410cbdac5c30d4130599031c1243632","observation_id":"0b4605ce-e2f9-4a44-b369-fb1b3ce0c8d8","resolution":{"observed_at":"2026-08-11T10:39:13.048780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.224845Z","title":"The claude 3 model family: Opus, sonnet, haiku anthropic","venue":null,"work_id":"c8d453fa-0360-4e48-bb24-09ac531a7eb1","year":null},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.054787Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:58b2bf89340d3dc3fd07c806dcc74ad36583646b0400f17d2ca75ddffaaef84c","observation_id":"7d2ed9a7-c46a-42fb-af2f-08c9b09e4faa","resolution":{"observed_at":"2026-08-11T10:39:14.228855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.215084Z","title":"c4ai-command-r-plus (revision 432fac1), 2024","venue":null,"work_id":"ef441f8c-bad5-4a0c-8ce2-4c9eb70e23a8","year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.058857Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:d5bfcd206fca08d86809dc97833afc7bee98ef2474458cdc489595e5aae0637e","observation_id":"cbf40da3-4e27-4863-aba0-aa07d0a9a394","resolution":{"observed_at":"2026-08-11T10:39:14.218457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-10T20:47:48.622277Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-08-11T10:39:13.062797Z","title":"Medalpaca – an open-source collection of medical conversational ai models and training data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.062797Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:543145af9851b7928d301eb03d072f1e2a21171380e40de998fae68b8002ad35","observation_id":"3bb3252c-7739-4755-8e41-32409a42b651","resolution":{"observed_at":"2026-08-11T10:39:13.062797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-11T10:39:13.066976Z","title":"Meditron-70b: Scaling medical pretraining for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.066976Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:633e08b7c984aa823491cf3e9272e7fba18e3c84b5989db00f6aaa69be4bce03","observation_id":"c174b541-ef20-4dd8-94be-d29cef10a521","resolution":{"observed_at":"2026-08-11T10:39:13.066976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.204163Z","title":"Adapting large language models via reading comprehension","venue":null,"work_id":"3b969352-2c11-4e24-882d-d3b550527b87","year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.071135Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:c7bd57ac88fac59af289a4dca42be96868697564b2a26615b0c1382538959f4e","observation_id":"41595a1a-adec-4342-8b9a-f523030e6bd4","resolution":{"observed_at":"2026-08-11T10:39:14.208020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12749","last_updated":"2024-11-02T03:17:34Z","snapshot_observed_at":"2026-08-11T16:02:29.548414Z","submitted_at":"2024-02-20T06:37:31Z","title":"Me LLaMA: Foundation Large Language Models for Medical Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12749","snapshot_observed_at":"2026-08-11T10:39:13.074576Z","title":"Me llama: Foundation large language models for medical applications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.074576Z"},"links":{"cited_paper":"/paper/2402.12749","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:c97af400bc6efb9921832d9e4a5fa30a924a1a1725494b66a506005c2faa7abf","observation_id":"35d18cd9-cbc0-4658-a6b4-3242d772fbcb","resolution":{"observed_at":"2026-08-11T10:39:13.074576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18416","last_updated":"2024-05-01T17:12:10Z","snapshot_observed_at":"2026-07-06T18:06:49.190172Z","submitted_at":"2024-04-29T04:11:28Z","title":"Capabilities of Gemini Models in Medicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18416","snapshot_observed_at":"2026-08-11T10:39:13.078230Z","title":"Capabilities of gemini models in medicine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.078230Z"},"links":{"cited_paper":"/paper/2404.18416","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:bd034db28a1dd156337b00c6b6a5c4dd89c383bd30948a668ac1d9c434056d11","observation_id":"5d8d85bb-7e4f-41ad-8784-dee45759fc1a","resolution":{"observed_at":"2026-08-11T10:39:13.078230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.192750Z","title":"https://tech.preferred.jp/ja/blog/llama3-preferred-medswallow-70b/","venue":null,"work_id":"7fa4435b-ec26-493f-8ad6-71ebae724010","year":null},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.081853Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:b3867b11ef9a38d0a91540bcb97979cd75796947321101d5d4db5a4494d9f429","observation_id":"b329100d-55eb-4fd0-ad09-cc32b2e20ce2","resolution":{"observed_at":"2026-08-11T10:39:14.196777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-10T21:55:43.802039Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-11T10:39:13.085436Z","title":"Textbooks are all you need","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.085436Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:81760595c90d52fc61864ff3097a695cf842c7c72a958d41b3e59331a2f24541","observation_id":"7d10fd7e-389a-4812-9b4b-f991d6a603da","resolution":{"observed_at":"2026-08-11T10:39:13.085436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-11T10:39:13.088973Z","title":"Textbooks are all you need ii: phi-1.5 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.088973Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:b1b25e1832817ea8718196d366a325516c74d6ed49aa105aa995611d731f49dc","observation_id":"96e01cf9-8ee2-4733-9a31-386abbb9c11b","resolution":{"observed_at":"2026-08-11T10:39:13.088973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-11T10:39:13.092651Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.092651Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:62f06067536fddb837808f594853803ae0c2244348115152b366534a2d694723","observation_id":"15bdc825-a308-4a28-a63f-48c584e9e5f6","resolution":{"observed_at":"2026-08-11T10:39:13.092651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.181099Z","title":"Wiki-40b: Multilingual language model dataset, 2020","venue":null,"work_id":"74c18811-93ff-4335-ac4f-31df463368a4","year":2020},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.096137Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:206d5796e5773776edc193dc6ea317037d60b3465002a07ce4eeac428d2a190c","observation_id":"34a31617-50cd-4a69-832e-85b7dcd749e3","resolution":{"observed_at":"2026-08-11T10:39:14.185305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.168730Z","title":"A monolingual approach to contextualized word embeddings for mid-resource languages","venue":null,"work_id":"2b0f6042-7929-4738-844a-c5c75212c837","year":null},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.099505Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:8e6d08a30b27b5bad19a7fab4ee6114246739f072fe346105084fa36fe9e801e","observation_id":"9d54e3cf-5532-49ae-9f3c-3cdb68704da8","resolution":{"observed_at":"2026-08-11T10:39:14.173380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.157595Z","title":"Random forests, 2001","venue":null,"work_id":"f209dfda-f7dd-4901-8c06-b9f291fd38af","year":2001},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.103342Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:d1c7bb839e2d9e74e8e0ed3c15c47b21095a05999747fad5ece25b55dd56f8d8","observation_id":"94e23ef3-d8a1-4236-baac-391deb451489","resolution":{"observed_at":"2026-08-11T10:39:14.161497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.145821Z","title":"Elyza-japanese-llama-2-7b, 2023","venue":null,"work_id":"cd3c6f21-6f50-4c70-b2d9-0eb2203a41f2","year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.106664Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:aaf2016e92082b03112782ef1ddf7a1973f5fb76a2c8da02b5b0875f5a5acca4","observation_id":"d14e8a9b-ecce-4cc5-95b7-f1cc57461e9d","resolution":{"observed_at":"2026-08-11T10:39:14.150060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.134887Z","title":"elyza/llama-3-elyza-jp-8b, 2024","venue":null,"work_id":"ac2e68b2-61d7-43d6-a222-4b74f56321d3","year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.110711Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:6f9f3275e7663a29c04ba03f00e56213d7e8ad6a8beb529e47e7cd4ae63df1ac","observation_id":"114067cc-729a-4815-a09a-6f67ef5490d3","resolution":{"observed_at":"2026-08-11T10:39:14.138730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.124628Z","title":"Japanese stablelm instruct alpha 7b v2","venue":null,"work_id":"d0f00812-8bb4-43ae-8753-1d9904b5f854","year":null},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.114190Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:59879d0bac459526917ab4ff5123df670692c8ef905347c9f5af8ac07bbe3a73","observation_id":"7ed5e0bf-a439-44da-a54c-3b1a42a8e2e6","resolution":{"observed_at":"2026-08-11T10:39:14.128165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.113518Z","title":"Tokenizerの違いによる日本語 bertモデルの性能評価","venue":null,"work_id":"71d2bbb8-5c21-4d26-bdf8-dce4660b4cfb","year":2021},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.117703Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:9c7ef3f896c28743c8060fd497536eae55f70e764c1bcb9c795c2a5056b998cf","observation_id":"d6e486f1-7cbd-4503-b5fd-9e6be76efc00","resolution":{"observed_at":"2026-08-11T10:39:14.117099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.102727Z","title":"日本語 gptを用いたトークナイザの影響の調査","venue":null,"work_id":"167d129b-c71e-453b-b22e-19aaff821685","year":2022},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.120966Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:db7bf77786d1424bfc74113ac542269a5074e942050485e13dedde0df4241ff6","observation_id":"da4f1951-5397-4c16-9183-5bb8b0e2420f","resolution":{"observed_at":"2026-08-11T10:39:14.106199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.091717Z","title":"日本語tokenizerの違いは下流タスク性能に影響を与えるか？ 言語処理学会第 29 回年 次大会, 2023","venue":null,"work_id":"c270b251-3fc8-4b9a-a9e9-1874061782e5","year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.124228Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:a69b330ad1a4d7831b33b89940d7c252d777c7fafbbecda7450b24bba3ba034f","observation_id":"1ef62143-dc18-406d-a36e-6ea40132b4ef","resolution":{"observed_at":"2026-08-11T10:39:14.095590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.076673Z","title":"Mecab: Yet another part-of-speech and morphological analyzer, 2006","venue":null,"work_id":"44e15a62-27c3-41fe-b0da-03e3df6de87a","year":2006},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.127418Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:780f853ee0c7dac213dcacbff471c5c00fe3441b5e458a648c3fcdeb6d278376","observation_id":"f2a479f4-d5f6-4aba-82c4-81463f864977","resolution":{"observed_at":"2026-08-11T10:39:14.080955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.063884Z","title":"J-medic: A japanese disease name dictionary based on real clinical usage","venue":null,"work_id":"1b36e75e-805b-4ce5-a8b6-70419167d944","year":2018},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.130742Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:6a239172e2b041b009b54400c804f51c79ee9ef69c631663390fb452d1794b74","observation_id":"71dc6ac9-f980-42d1-b00c-ce37c10da179","resolution":{"observed_at":"2026-08-11T10:39:14.068260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10959","last_updated":"2018-04-29T16:13:44Z","snapshot_observed_at":"2026-07-06T06:36:17.283404Z","submitted_at":"2018-04-29T16:13:44Z","title":"Subword Regularization: Improving Neural Network Translation Models with Multiple Subword Candidates","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10959","snapshot_observed_at":"2026-08-11T10:39:13.134050Z","title":"Subword regularization: Improving neural network translation models with multiple subword candidates","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.134050Z"},"links":{"cited_paper":"/paper/1804.10959","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:3ae815f7a3f3125b4021fae04f9e525c977b5c6ae7feb1fc0e52a36d8f8079dd","observation_id":"b04fd036-90bc-4816-8812-ad47f96d47ae","resolution":{"observed_at":"2026-08-11T10:39:13.134050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-12T04:55:58.532015Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-11T10:39:13.137797Z","title":"Roformer: Enhanced transformer with rotary position embedding.http://arxiv.org/abs/2104.09864, 4 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.137797Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:bcbd44d3aa312cbb13752d1f85b3099aff3ef37b203dcc6a608282d20ec78279","observation_id":"38a01a1e-e6e2-4eaf-86ce-4ec5a6211e39","resolution":{"observed_at":"2026-08-11T10:39:13.137797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.04745","last_updated":"2020-06-29T07:55:12Z","snapshot_observed_at":"2026-08-06T10:39:08.684653Z","submitted_at":"2020-02-12T00:33:03Z","title":"On Layer Normalization in the Transformer Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.04745","snapshot_observed_at":"2026-08-11T10:39:13.141183Z","title":"On layer normalization in the transformer architecture","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.141183Z"},"links":{"cited_paper":"/paper/2002.04745","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:98462a6ef153fe90fc7848999237df581b95447950882e78aa5bbe023ee9147c","observation_id":"d870d6bf-f7ab-4c69-a36c-ad634cc81328","resolution":{"observed_at":"2026-08-11T10:39:13.141183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.12322","last_updated":"2019-06-13T17:55:30Z","snapshot_observed_at":"2026-08-04T04:17:53.148033Z","submitted_at":"2019-05-29T10:50:32Z","title":"A Study of BFLOAT16 for Deep Learning Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.12322","snapshot_observed_at":"2026-08-11T10:39:13.145659Z","title":"A study of bfloat16 for deep learning training","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.145659Z"},"links":{"cited_paper":"/paper/1905.12322","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:a692cece7d242d133c46741cd9f266a90051b4a98818e52affe9e3245f7cf607","observation_id":"0caf0547-241e-4453-a35e-2df0af2e1f27","resolution":{"observed_at":"2026-08-11T10:39:13.145659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-11T10:39:13.150689Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.150689Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:f8d71379dad701b9a1e18698fd809606ca70f6e6169c45651d80f12891357093","observation_id":"c1fdf9e4-b470-49d0-bf9d-0cc942d2f3b1","resolution":{"observed_at":"2026-08-11T10:39:13.150689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.03118","last_updated":"2017-11-02T02:48:38Z","snapshot_observed_at":"2026-08-02T23:09:11.731136Z","submitted_at":"2017-02-10T10:04:30Z","title":"Sigmoid-Weighted Linear Units for Neural Network Function Approximation in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.03118","snapshot_observed_at":"2026-08-11T10:39:13.155677Z","title":"Sigmoid-weighted linear units for neural network function approximation in reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.155677Z"},"links":{"cited_paper":"/paper/1702.03118","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:66d9de3f50566718a78e352bb0e326f4bbb554ffd074bccbcd92c197b23fa517","observation_id":"311170ea-5d94-4f0e-a6ee-6a378613da1b","resolution":{"observed_at":"2026-08-11T10:39:13.155677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.159591Z","title":"Rectified linear units improve restricted boltzmann machines","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.159591Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:dee81e3560c6b27d00bba1d5b135c9f7c48f04b2c61d52d486a3c8b9d563efcf","observation_id":"eea3255e-b91c-4756-9d75-e3b36df570eb","resolution":{"observed_at":"2026-08-11T10:39:13.159591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-12T04:19:02.139595Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-11T10:39:13.163709Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.163709Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:a1d8c4b7c364099909579ddd4749f32bddadd05f1c4743585f3d76bcd3d5d263","observation_id":"c7efce8a-392d-4dc1-b318-235e93a12787","resolution":{"observed_at":"2026-08-11T10:39:13.163709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07467","last_updated":"2019-10-16T16:44:22Z","snapshot_observed_at":"2026-08-08T08:22:25.110228Z","submitted_at":"2019-10-16T16:44:22Z","title":"Root Mean Square Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07467","snapshot_observed_at":"2026-08-11T10:39:13.167209Z","title":"Root mean square layer normalization","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.167209Z"},"links":{"cited_paper":"/paper/1910.07467","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:7474a533f10667349b3fb41edc6aeef0c4b646c8bcd3dbf7d28108da91d907a2","observation_id":"bfa6a62a-8e99-4fd6-9c4e-7ea26d8f34de","resolution":{"observed_at":"2026-08-11T10:39:13.167209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-11T10:39:13.170947Z","title":"Gqa: Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.170947Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:739678437b2b4b7a470c30f95bbd2eff97f65fcb2472c4149e0774d07fba105d","observation_id":"51a9d31f-f6a3-487e-864d-5abe630d88f5","resolution":{"observed_at":"2026-08-11T10:39:13.170947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-11T10:39:13.174118Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.174118Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:d659d01eee3c5a6c867f5b6d2dd1d9e5a506a124edafc32a8c7e4d357b3b3b53","observation_id":"4a26e3c6-3473-4a8d-9a9b-2e7dc797a5d1","resolution":{"observed_at":"2026-08-11T10:39:13.174118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-11T10:39:13.177474Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.177474Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:4d8cb859ddab32f707dd134506b7b1382c4511ee8470f5d25a9be3109186e639","observation_id":"6614e3d3-6635-4f6c-b57a-432754d6d3a9","resolution":{"observed_at":"2026-08-11T10:39:13.177474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05895","last_updated":"2019-12-30T03:53:04Z","snapshot_observed_at":"2026-08-07T19:31:58.707080Z","submitted_at":"2019-10-14T02:23:43Z","title":"Transformers without Tears: Improving the Normalization of Self-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05895","snapshot_observed_at":"2026-08-11T10:39:13.181022Z","title":"Nguyen and Julian Salazar","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.181022Z"},"links":{"cited_paper":"/paper/1910.05895","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:64f3493dc8c9bf430413dee6a63a9b2723102488549900296a9b0b2c8c4d00bf","observation_id":"e2c958ff-23a6-4503-94e2-22a7247e9011","resolution":{"observed_at":"2026-08-11T10:39:13.181022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16903","last_updated":"2025-07-25T05:09:17Z","snapshot_observed_at":"2026-08-10T02:05:33.826494Z","submitted_at":"2023-12-28T08:53:27Z","title":"Spike No More: Stabilizing the Pre-training of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16903","snapshot_observed_at":"2026-08-11T10:39:13.184328Z","title":"Spike no more: Stabilizing the pre-training of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.184328Z"},"links":{"cited_paper":"/paper/2312.16903","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:b08261c33b3d952862c7be3939a4338e4dd06a161d93d9e891ab78ac70f93321","observation_id":"ddb73ce6-27b2-4e9e-a0ec-878948fd8ead","resolution":{"observed_at":"2026-08-11T10:39:13.184328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.187575Z","title":"Understanding the difficulty of training deep feedforward neural networks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.187575Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:b2e9e5d6b15ba490cb5d376b486953c2eb617b43c8279282a51f317d5d2b8926","observation_id":"36971bae-8b5b-4cf6-910b-f816dd3656ce","resolution":{"observed_at":"2026-08-11T10:39:13.187575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T10:39:13.190608Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.190608Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:d8b94c05da681a7748dc8dd831f041f9957f38c5918870b539fcf46cd0466a1a","observation_id":"5c384ed7-9ff4-4940-8329-6d898e982cf2","resolution":{"observed_at":"2026-08-11T10:39:13.190608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.034553Z","title":"To repeat or not to repeat: Insights from scaling llm under token-crisis","venue":null,"work_id":"464bf8f9-f87b-4d01-96f1-a34ee066ca22","year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.193791Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:2309db2311bacb4048205e71614b513fbf8cb3fb663cf2ca96a5bdd768aa0d95","observation_id":"a83da540-a1cf-475f-8226-c76a0d8027e3","resolution":{"observed_at":"2026-08-11T10:39:14.039066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-11T10:39:13.197528Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.197528Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:388c9c9f2efac3d26e94c843aedb6d29756fe233847c1bc5fa677b19ae022a46","observation_id":"4ee7718f-f647-4621-b589-afdbce40607a","resolution":{"observed_at":"2026-08-11T10:39:13.197528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:14.020437Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":"2343c489-a4e1-4047-90eb-3c45a7412841","year":2020},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.200798Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:4c12e34b9b6a295c26074bafc2ceb2b9e2306f2d658dffe9b8ed65cf46b3d41f","observation_id":"e7d91509-4508-403c-bbcd-922ca04efdaf","resolution":{"observed_at":"2026-08-11T10:39:14.025311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.204212Z","title":"Zero: Memory optimizations toward training trillion parameter models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.204212Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:bd3b96fbdd0e1aaf18c238b216671820028902e87e79dd6ae58bd60ac8c6b753","observation_id":"477182ab-a284-43c1-a5c6-2f301c004475","resolution":{"observed_at":"2026-08-11T10:39:13.204212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.0580","last_updated":"2012-07-03T06:35:15Z","snapshot_observed_at":"2026-07-06T02:51:07.275676Z","submitted_at":"2012-07-03T06:35:15Z","title":"Improving neural networks by preventing co-adaptation of feature detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.0580","snapshot_observed_at":"2026-08-11T10:39:13.207736Z","title":"Hinton, Nitish Srivastava, Alex Krizhevsky, Ilya Sutskever, and Ruslan R","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.207736Z"},"links":{"cited_paper":"/paper/1207.0580","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:c0d903205dc5397f8485257a62b944e00ae7aa99ff08eac9882d03071056bf5a","observation_id":"a43dddb2-933b-486e-9d75-1c8d10d556ef","resolution":{"observed_at":"2026-08-11T10:39:13.207736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T10:39:13.211250Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.211250Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:1cf5e24bfbc58c9419e1cabf9de116105278fb41cd20eee17d03cd286f01a347","observation_id":"705a9c5d-4b9c-45a7-9b33-d14d3e47c041","resolution":{"observed_at":"2026-08-11T10:39:13.211250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.996104Z","title":"Finetuned language models are zero-shot learners closed-book qa","venue":null,"work_id":"db971dd0-2bba-4429-bd30-dd9798375660","year":2022},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.214889Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:c5b72fe203f022dd1f7b1815a84e6a4b3beeffd76a5ba59853726d06e952216e","observation_id":"43bde543-35c3-4297-bf4b-a1b818a52fa8","resolution":{"observed_at":"2026-08-11T10:39:14.000112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.983656Z","title":"Jmed-llm: Japanese medical evaluation dataset for large language models","venue":null,"work_id":"d2f72f11-66fd-4530-b7f8-a92163fe4a26","year":2024},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.218270Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:5359ce0b798fdccdd3a3c222dafa63df7da30373286d18181392bbc1c49ec359","observation_id":"5fa8c98b-852d-4078-a128-9b04b94821e8","resolution":{"observed_at":"2026-08-11T10:39:13.987590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05914","last_updated":"2023-10-10T17:31:00Z","snapshot_observed_at":"2026-08-12T05:13:32.551469Z","submitted_at":"2023-10-09T17:58:34Z","title":"NEFTune: Noisy Embeddings Improve Instruction Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05914","snapshot_observed_at":"2026-08-11T10:39:13.222272Z","title":"Neftune: Noisy embeddings improve instruction finetuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.222272Z"},"links":{"cited_paper":"/paper/2310.05914","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:e4cb560f56209494a2990a72e47fa81473fc9f1293dff0433c976e7f62ac4e6c","observation_id":"09c55050-6339-41d1-90a7-c01c1bb53df2","resolution":{"observed_at":"2026-08-11T10:39:13.222272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18027","last_updated":"2023-04-05T07:53:37Z","snapshot_observed_at":"2026-08-11T10:29:06.956515Z","submitted_at":"2023-03-31T13:04:47Z","title":"Evaluating GPT-4 and ChatGPT on Japanese Medical Licensing Examinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18027","snapshot_observed_at":"2026-08-11T10:39:13.226775Z","title":"Evaluating gpt-4 and chatgpt on japanese medical licensing examinations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.226775Z"},"links":{"cited_paper":"/paper/2303.18027","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:0dc326297ab2842b0c2cee9f110f894b1d59452c9a18ae1ddcda2132ec62bef3","observation_id":"11dc413d-02cc-4f53-8575-97b11226bca3","resolution":{"observed_at":"2026-08-11T10:39:13.226775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.971671Z","title":"A coefficient of agreement for nominal scales","venue":null,"work_id":"77622c58-6eda-4de9-8ed3-67334e6be841","year":1960},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.230884Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:0fde4ac1b75e7411bd8ad729b9eb4f76dfa5f5fd7f846de5511d8acfe3b0b364","observation_id":"30230f99-cb9c-460c-9483-7cb091d77973","resolution":{"observed_at":"2026-08-11T10:39:13.975489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.955303Z","title":"https://speakerdeck.com/fta98/ri-ben-yu-yi-liao-llmping- jia-bentimakunogou-zhu-toxing-neng-fen-xi","venue":null,"work_id":"81345828-4bb6-4d1e-95f6-35b2995365b9","year":null},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.235969Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:c30ebf45bdf28424c8dc4b9921bebccb0168d9cf4a128859afc5ff80d3125c67","observation_id":"6ec42609-61eb-4fd4-aa2b-0768e5b43ec3","resolution":{"observed_at":"2026-08-11T10:39:13.963082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17493","last_updated":"2024-04-14T05:20:10Z","snapshot_observed_at":"2026-08-05T16:03:40.517679Z","submitted_at":"2023-05-27T15:10:41Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17493","snapshot_observed_at":"2026-08-11T10:39:13.243133Z","title":"The curse of recursion: Training on generated data makes models forget","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.243133Z"},"links":{"cited_paper":"/paper/2305.17493","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:b5c40c1ce33b5950c93acfd4dfcfd23f71c0420ff8df401bd7425a06e2965fd0","observation_id":"0f4c283a-7548-43ac-9254-64b4610e6197","resolution":{"observed_at":"2026-08-11T10:39:13.243133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:39:13.248412Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.248412Z"},"links":{"citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:1314c2988c2f731f083bb446b30c39766fcf8aa88134d5f3ee9743e7f4c48e26","observation_id":"fa54500e-8c51-4e05-9268-799d3ab17e3d","resolution":{"observed_at":"2026-08-11T10:39:13.248412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-11T10:39:13.252776Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.252776Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:5efc3967cd10cad4e387f4cf3dc839a377242e0f88982e3cf132fa7f308a31cc","observation_id":"0c2a9cf6-d1fa-46cb-b96f-0befd4f8109c","resolution":{"observed_at":"2026-08-11T10:39:13.252776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-11T10:39:13.256643Z","title":"Efficient estimation of word representations in vector space","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T10:39:13.256643Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2412.16423"},"observation_digest":"sha256:08332218b9a11385958f1094217610f787784c1fbd171f2ccd89642d01ed4c08","observation_id":"4af789d2-8ded-4c0a-a012-901cd8565cc1","resolution":{"observed_at":"2026-08-11T10:39:13.256643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.16423","last_updated":"2024-12-21T01:12:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T19:24:45.153540Z","submitted_at":"2024-12-21T01:12:48Z","title":"Technical Report: Small Language Model for Japanese Clinical and Medicine"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2412.16423."}