jslin09
/

gemma2-2b-fraud

Text Generation

text-generation-inference

Inference Endpoints

Model card Files Files and versions Community

jslin09 commited on Nov 13, 2024

Commit

23035b6

·

verified ·

1 Parent(s): 30ab1ca

Update README.md

Files changed (1) hide show

README.md +4 -0

README.md CHANGED Viewed

@@ -35,6 +35,10 @@ library_name: transformers
 # 判決書「犯罪事實」欄草稿自動生成
 本模型是以司法院公開之「詐欺」案件判決書做成之資料集，基於 [Google Gemma2:2b](https://huggingface.co/google/gemma-2-2b) 模型進行微調訓練，可以自動生成詐欺及竊盜案件之犯罪事實段落之草稿。資料集之資料範圍從100年1月1日至110年12月31日，所蒐集到的原始資料共有 74823 篇（判決以及裁定），我們只取判決書的「犯罪事實」欄位內容，並把這原始的資料分成三份，用於訓練的資料集有59858篇，約佔原始資料的80%，剩下的20%，則是各分配10%給驗證集（7482篇），10%給測試集（7483篇）。在本網頁進行測試時，請在模型載入完畢並生成第一小句後，持續按下Compute按鈕，就能持續生成文字。或是輸入自己想要測試的資料到文字框中進行測試。或是可以到[這裡](https://huggingface.co/spaces/jslin09/legal_document_drafting)有更完整的使用體驗。
 # 使用範例
 如果要在自己的程式中調用本模型，可以參考下列的 Python 程式碼，藉由呼叫 API 的方式來生成刑事判決書「犯罪事實」欄的內容。
 <details>

 # 判決書「犯罪事實」欄草稿自動生成
 本模型是以司法院公開之「詐欺」案件判決書做成之資料集，基於 [Google Gemma2:2b](https://huggingface.co/google/gemma-2-2b) 模型進行微調訓練，可以自動生成詐欺及竊盜案件之犯罪事實段落之草稿。資料集之資料範圍從100年1月1日至110年12月31日，所蒐集到的原始資料共有 74823 篇（判決以及裁定），我們只取判決書的「犯罪事實」欄位內容，並把這原始的資料分成三份，用於訓練的資料集有59858篇，約佔原始資料的80%，剩下的20%，則是各分配10%給驗證集（7482篇），10%給測試集（7483篇）。在本網頁進行測試時，請在模型載入完畢並生成第一小句後，持續按下Compute按鈕，就能持續生成文字。或是輸入自己想要測試的資料到文字框中進行測試。或是可以到[這裡](https://huggingface.co/spaces/jslin09/legal_document_drafting)有更完整的使用體驗。
+# 比較
+![ROUGE-L](https://i.imgur.com/XiAEH1B.png)
 # 使用範例
 如果要在自己的程式中調用本模型，可以參考下列的 Python 程式碼，藉由呼叫 API 的方式來生成刑事判決書「犯罪事實」欄的內容。
 <details>