ローカルLLM– tag –
-
AI-Tools
654KBのSanoTTS-JPを3GBのIrodoriと聴き比べた
マイコンで動く0.65MBの日本語TTS「SanoTTS-JP」と3GBのIrodori-TTSを同じ13文で聴き比べ。速さは約270倍、聞き取り誤りは10.7%対0.25%。半角の数字と英字が無音で消える落とし穴と、全角化での回避法まで実音声つきで紹介。 -
AIツール
DeepSeek Harnessのキャッシュヒット率はOllamaで出ない
DeepSeek Harnessのキャッシュヒット率がOllamaで表示されない理由を実測と一次情報で解説。prompt_eval_countは不変、prompt_eval_durationは31.983秒→0.042秒。vLLM・SGLangでの計測フラグも紹介します。 -
AI-Tools
Irodori-TTSの自分専用ニュースを61日間毎日車で聞いた
ローカルTTS(Irodori-TTS v4.1-Small)で自分専用のAIニュースPodcastを61日間運用した実測ログ。41本・12.2時間・台本173,399字。英字残存20.8%の失敗と、生成が音声長の2.5〜3倍かかる現実まで公開。 -
ローカルLLM
FreeTokenは8GB GPUで35B動く、RAM 32GBなら
FreeTokenをarXiv論文とGitHub公式ドキュメントで検証。8GB GPUで35Bが39.3 tok/s動くのは事実ですが、同じ機材にhost RAM 32GBが載っています。報道の速度比較表が別モデルの数値だった件と、macOS非対応の現状を実測ベースで解説します。 -
ローカルLLM
Qwen3.8 27Bは16GB Macで動く、2bitなら
Qwen3.8-27BをM5 MacBook Pro 16GBで実測。IQ3_XXS(10.93GB)はdecode 0.22 tok/s、Q2_K_XL(9.83GB)は2.47〜4.52 tok/s。1.1GBの差で20倍変わる境界線とOllamaの設定手順を解説します。 -
AIツール
【2026年8月】OllamaでDeepSeek Harnessを起動する方法 — ollama launch dsh 完全ガイド
Ollama v0.32.11から追加された「ollama launch dsh」で、Claude CodeのOSS代替DeepSeek Harnessを1コマンドで起動。実測162〜258 tok/s・TTFT約1秒。手動settings.yaml不要の自動設定を解説します。 -
AI-Tools
Kimi K3は「誰でも使える」OSSなのか?三重の入手困難を検証
オープンソースのKimi K3は本当に誰でも使えるのか。Moonshot本家とOllama Cloud Maxの新規登録停止、セルフホストの非現実性を一次情報で検証します。 -
Local-LLM
【2026年最新】16GBのMacで動くローカルコーディングLLM「Ornith-1.0」完全ガイド — Claude Code連携とqwen3-coder実測比較
「ローカルLLMでコーディングしたいけど、自分のマシンのメモリで本当に動くの?」 – これは、クラウドにコードを出したくない人がローカルLLMを試すとき、最初にぶつかる壁です。 2026年6月25日、その問いに新しい答えが出ました。DeepReinforce社がリリ... -
Local-LLM
ローカル日本語音声入力 完全ガイド|TypeWhisper実測比較
機密情報を扱うため音声入力をクラウドに出せない方へ。MacでローカルのQwen3 ASR・WhisperKit・ParakeetをTypeWhisperで実測CER比較。どれが日本語に強いかを数値(Qwen3 7.8%)で解説します。 -
Local-LLM
【2026年最新】whichllmで自分のMacに最適なローカルLLMを選ぶ完全ガイド
ローカルLLM選びの「結局どれを入れれば?」をwhichllmが1コマンドで解決。Apple M5 16GBの実測ランキングをもとに、VRAM最大=最適の誤解・Ollamaとの役割分担・読み解き方を解説します。