ローカルLLM

新着順 人気順

vLLMとRDMAで構築するローカルLLMクラスタ (11):レビュー指摘を直し、開発サイクルを閉じる

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (10)」の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (10):ゲート分割でローカルLLMにソフトウェアを実装させる

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (9)」の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (9):共有ストレージ上のエージェントで計算ノードを立ち上げる

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (8)」の内容を踏まえた続編です。

ローカル LLM で MCP 経由で Kubernetes を操作する

ローカルの llama.cpp と kubernetes-mcp-server を MCP でつなぎ、LLM に Kubernetes を操作させてみました。yaml 生成は速く簡単な例題はこなすものの、試行錯誤が多く、常識的なセキュリティ判断もまだ甘い——ローカル MCP の現在地を率直に記録します。

vLLMとRDMAで構築するローカルLLMクラスタ (8):LLM wiki を試す

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (7)」の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (7):LLM が LLM を管理する逆説――OpenClaw が示す自律運用の射程と限界

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (6)」の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (6):Claude Code をローカルLLMで動かす

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (5)」の内容を踏まえた続編です。

【衝撃】vLLMの使い方を生成AIに聞きつづけた末路

Ryzen AI Max+ 395 (メモリ128GB) で Qwen3-Coder-Next を vLLM で動かそうと、Gemini と共に一晩格闘した記録です。AIの自信満々な誤誘導 (FP8非対応) に振り回され、パンが焼き上がるのを待ちながら深夜にソースコードを改変し、最終的に見えてきた「1.2ト…

vLLMとRDMAで構築するローカルLLMクラスタ (5):Open-WebUIによるRAG基盤構築とAMD GPUの活用

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (4)」の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (4):PCIeボトルネックの解消とNFS over RDMA

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の「vLLMとRDMAで構築するローカルLLMクラスタ (3)」の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (3):4ノード分散推論の実装とスケーラビリティ検証

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 前回の『vLLMとRDMAで構築するローカルLLMクラスタ (2)』の内容を踏まえた続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (2):VRAMの壁を突破する分散実行のアプローチ

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。 本記事は「vLLMとRDMAで構築するローカルLLMクラスタ (1)」の続編です。

vLLMとRDMAで構築するローカルLLMクラスタ (1):安価なGPU選定と25GbEネットワークの基礎

Linux PC と RDMA ネットワークで vLLM スケールアウト構成を構築し、コストパフォーマンス重視のローカルLLM実行環境を提案・検証します。

ローカルLLMとRAGで自分の外部記憶を強化しよう (2)

NVLINK Bridgeで接続した2台のRTX6000 GPUをFalcon 4205 を介して2台の1Uサーバから接続して LLM + RAG を動作させる実験です。

ローカルLLMとRAGで自分の外部記憶を強化しよう

ローカルLLMとRAGを用いて自分の外部記憶にいろいろと質問できるようにする方法を入門的に紹介します。