778a0a's microblog

logs about gamedev

軍勢処理作成中...

ブログを独自ドメインに移行してみた。 https://blog.778a0a.com/

778a0aの日記
778a0aの日記 778a0aの日記

当面見た目は気にしない()

必要最低限の機能を実装するのを最優先にする。 UIの実装も進めつつ、そろそろ軍勢の実装も始めていく。

image.png

あまり進まず。

image.png

CK3っぽいUIにしてみる。

image.png

https://www.youtube.com/watch?v=WJRf7dh5Zws

面白かった。

solidjs, preact: ビルドなしモードが良さそう lit: 妙に評価が高いのが気になった

YouTube
JavaScript Framework Tier List I'm so sorry that I had to do this.Check out my Twitch, Twitter, Discord more at https://t3.ggKeywords REACT ANGULAR FLUTTER VUE SOLID SVELTE ASTRO QWIK NEXT...

今日はさっさと寝る。23時就寝の習慣を取り戻す。(朝型化は時期尚早だった)

といいつつもったいないのでOpenAIのファインチューニングも色々したい。データを作るのが大変だけど。

振り返り、目標立てはいったん終わり。先月は進捗が全然だったので、今月はゲーム開発最優先で頑張る。

画像系をCDNでキャッシュするようにしたら多少読み込みが早くなった。

test2

test

月の振り返りを行う。

fastapiでなにか作ってみる

llamaだとシングルGPUでフルファインチューニングもできそう https://llama.meta.com/docs/how-to-guides/fine-tuning/

llama.meta.com
Fine-tuning | How-to guides Full parameter fine-tuning is a method that fine-tunes all the parameters of all the layers of the pre-trained model.

ファインチューニングモデルだと、データの傾向に従って長い出力をするようになったけど、後半部分がかなり怪しい感じになっている。対策としてデータのバリアンスを増やすのもありかもだけど、LoRA系の手法の限界もあるのかもしれない。

ある学習データは、約18万トークンだった。(システムやユーザープロンプト等は除いた純粋なデータのトークン数)

料金は以下の通りなので、

gpt-4o-2024-08-06: $25.000 / 1M training tokens
    ファインチューニングモデルの推論の料金:
    $3.750 / 1M input tokens
    $15.000 / 1M output tokens
gpt-4o-mini-2024-07-18: $3.000 / 1M training tokens
    ファインチューニングモデルの推論の料金:
    $0.300 / 1M input tokens
    $1.200 / 1M output tokens

(推論はバッチモードなら半額)

1エポックあたり、4oなら$3(450円)、4o-miniなら$0.6(90円) 3エポックなら、$9(1350円)、4o-miniなら$1.8(270円)

4oは、1日1Mトークン($25)まで無料。一日5エポック無料学習可能 4o-miniは2Mトークン($6)まで無料。一日10エポック無料学習可能 9/23まで。

ファインチューニング中。

エポック数は自動にすると、入力ファイルのバリデーションが済む前に3になっていた。学習過程のメトリクス等ではなく、データ量?に応じて決められていそう。

image.png

面白い。

image.png

時間がないので今日も進捗なし。

拡大画像