MENU
  • 導入戦略・はじめ方
  • 実践事例・現場レポート
  • AI
「このサイトでは広告を利用しています」 | AI技術ラボ - 現場目線の本音レビュー
AI技術ラボ - 現場目線の本音レビュー
  • 導入戦略・はじめ方
  • 実践事例・現場レポート
  • AI
AI技術ラボ - 現場目線の本音レビュー
  • 導入戦略・はじめ方
  • 実践事例・現場レポート
  • AI
  1. ホーム
  2. ローカルLLM

ローカルLLM– category –

  • ローカルLLM

    FreeTokenは8GB GPUで35B動く、RAM 32GBなら

    FreeTokenをarXiv論文とGitHub公式ドキュメントで検証。8GB GPUで35Bが39.3 tok/s動くのは事実ですが、同じ機材にhost RAM 32GBが載っています。報道の速度比較表が別モデルの数値だった件と、macOS非対応の現状を実測ベースで解説します。
    2026年8月24日
  • ローカルLLM

    Qwen3.8 27Bは16GB Macで動く、2bitなら

    Qwen3.8-27BをM5 MacBook Pro 16GBで実測。IQ3_XXS(10.93GB)はdecode 0.22 tok/s、Q2_K_XL(9.83GB)は2.47〜4.52 tok/s。1.1GBの差で20倍変わる境界線とOllamaの設定手順を解説します。
    2026年8月23日
  • ローカルLLM

    bitnet.cpp完全ガイド — GPUなしでLLMを動かす1ビット推論フレームワーク

    Microsoft発のbitnet.cppで、GPUなし・CPUだけでLLMを動かす方法を完全解説。1ビット推論の仕組み、対応モデル、インストール手順、llama.cppとの比較まで網羅。
    2026年4月13日
  • ローカルLLM

    【2026年完全版】ローカルLLM完全ガイド|API費用ゼロ・プライバシー安全なAI開発環境の構築方法

    ローカルLLMの導入から活用まで完全解説。Ollama・LM Studio・Claude Codeとの連携、Windows環境セットアップ、よくある質問まで網羅。API費用ゼロでAI開発を始める方法を製造業SEエンジニアが実機検証。
    2026年3月15日
1

Recent Posts

  • 654KBのSanoTTS-JPを3GBのIrodoriと聴き比べた
  • NVIDIAのKVキャッシュ移植が25倍速い理由を解剖する
  • DeepSeek Harnessのキャッシュヒット率はOllamaで出ない
  • AIエージェントが夜間障害を13分で切る条件はMarkdown 107枚
  • ビル・ゲイツの警告を読んで、役割を変えると決めた

Recent Comments

表示できるコメントはありません。

ご支援お待ちしております