名古屋出身ソフトウェアエンジニアのブログ

カテゴリ: 実験

2 / 2 ページ

LLaMA 2 日本語モデルを CPU 実行する

LLaMA 2 日本語モデルを CPU 実行する
M2 MacBook Pro にて、Llama.cpp を使い量子化済みの LLaMA 2 派生モデルを実行することに成功したので手順をメモします。 Llama.cpp は言語モデルをネイティブコードによって CPU 実行するためのプログラムであり、Apple Silicon 最適化を謳っていることもあってか、かなり高速に動かせました。 …

Mypy による型チェック入門

元所属していた研究室の方が Mypy を使っているのを観測し、今はどの程度使えるようになっているのか、使用感などを体験してみることにしました。 …