Ollama– tag –
-
AIツール
DeepSeek Harnessのキャッシュヒット率はOllamaで出ない
DeepSeek Harnessのキャッシュヒット率がOllamaで表示されない理由を実測と一次情報で解説。prompt_eval_countは不変、prompt_eval_durationは31.983秒→0.042秒。vLLM・SGLangでの計測フラグも紹介します。 -
ローカルLLM
Qwen3.8 27Bは16GB Macで動く、2bitなら
Qwen3.8-27BをM5 MacBook Pro 16GBで実測。IQ3_XXS(10.93GB)はdecode 0.22 tok/s、Q2_K_XL(9.83GB)は2.47〜4.52 tok/s。1.1GBの差で20倍変わる境界線とOllamaの設定手順を解説します。 -
AIツール
【2026年8月】OllamaでDeepSeek Harnessを起動する方法 — ollama launch dsh 完全ガイド
Ollama v0.32.11から追加された「ollama launch dsh」で、Claude CodeのOSS代替DeepSeek Harnessを1コマンドで起動。実測162〜258 tok/s・TTFT約1秒。手動settings.yaml不要の自動設定を解説します。 -
AIツール
【2026年】DeepSeek V4 Flash完全ガイド — 実機レビュー・性能・コスト・始め方まで徹底解説
DeepSeek V4 Flash(ビルド0731)をOllama Cloudで1日使ってみた実体験レビュー。アーキテクチャ、ベンチマーク、Claude/GPTとのコスト比較、APIの始め方まで完全網羅。 -
AI-Tools
Kimi K3は「誰でも使える」OSSなのか?三重の入手困難を検証
オープンソースのKimi K3は本当に誰でも使えるのか。Moonshot本家とOllama Cloud Maxの新規登録停止、セルフホストの非現実性を一次情報で検証します。 -
Local-LLM
【2026年最新】16GBのMacで動くローカルコーディングLLM「Ornith-1.0」完全ガイド — Claude Code連携とqwen3-coder実測比較
「ローカルLLMでコーディングしたいけど、自分のマシンのメモリで本当に動くの?」 – これは、クラウドにコードを出したくない人がローカルLLMを試すとき、最初にぶつかる壁です。 2026年6月25日、その問いに新しい答えが出ました。DeepReinforce社がリリ... -
Local-LLM
【2026年最新】whichllmで自分のMacに最適なローカルLLMを選ぶ完全ガイド
ローカルLLM選びの「結局どれを入れれば?」をwhichllmが1コマンドで解決。Apple M5 16GBの実測ランキングをもとに、VRAM最大=最適の誤解・Ollamaとの役割分担・読み解き方を解説します。 -
Local-LLM
【2026年最新】GLM-5.2をClaude Codeで動かす実測ガイド — Ollama Cloudなら自前GPU不要、ただし無料枠では動かない
756BのOSSモデルGLM-5.2をOllama Cloud経由でClaude Codeのバックエンドにする手順を実測で解説。生成速度56 tok/s、Pro課金が必須になる「403の壁」、料金の判断軸まで網羅。 -
Local-LLM
Claude Codeを動かすローカルLLM 4ツール、実用は1つ
Claude Codeをローカルで動かす4ツール(Ollama/LM Studio/Lemonade/Foundry Local)をMac視点で整理。API費用ゼロ・機密コードを外に出さない構成を、選び方の判断軸と実機検証で解説します。 -
AI・機械学習 / セキュリティ
【2026年最新】Ollama認証セキュリティ「31%問題」完全ガイド — 100万台スキャンで判明した罠と対策
Ollamaを公開しているサーバーの31%が認証なし — 2026年5月の100万台スキャン報告で判明した衝撃の事実と、Nginx・Caddy・Cloudflare Tunnelによる具体的な認証実装、CVE-2026-7482「Bleeding Llama」を含む既知脆弱性の対策まで実例コード付きで完全解説。