AI

4×RTX 3090サーバーがvLLM負荷で電源断?XServer VPSで同時1・2・4・8を実測

4×RTX 3090サーバーがvLLM負荷で電源断する悩みを検討。XServer VPSへ同時1・2・4・8で64件送り、p95、エラー、RAM、OOM、公開API生存を実測しました。
AI

RTX 3090を7枚積むと2450W?XServer VPSへ80ジョブ移して自宅GPU非使用を実測

RTX 3090を7枚積むとGPU公称値だけで2450W。XServer VPSへQwen3ジョブ80件を移し、自宅PCのGPU Compute非使用、CPU、VPS負荷を実測しました。
AI

Macは長いコンテキストでRTXより遅い?XServer VPSで532・2287・4537トークン実測

Macは長いコンテキストでRTXより遅いのか。XServer VPSのQwen3へ532・2287・4537トークンを渡し、prefill時間、総時間、RAM、増加率を実測しました。
AI

Mac Studio 192GBか中古RTX 3090×2か?XServer VPSで48GiB要求を起動前判定

Mac Studio 192GBか中古RTX 3090×2か。XServer VPS 4GBで1・3・48・192GiB級要求を実測判定し、巨大モデルを起動せず安全に拒否できるか検証しました。
AI

i7-14700KへGPU追加かMac Studio・DGX Sparkか?XServer VPSへ40ジョブ逃がしてPC負荷実測

i7-14700K機へGPU追加か、Mac Studio M3 Ultra・DGX Sparkか。XServer VPSへQwen3固定ジョブ40件を逃がし、自宅PCのCPU・RAM・GPU負荷を実測。騒音・熱・電力の未測定範囲も明記します。
AI

Mac Studio 192GBとNVIDIA CUDAは両立できない?XServer VPS分離構成を実測

Mac Studio 192GBの容量とNVIDIA CUDAを1台で両立しにくい悩みを、XServer VPS・自宅PC・分離構成の同一Qwen3ジョブで実測。速度、常時稼働性、制約を比較します。
AI

RTX 4090 PC・API・XServer VPSはどれが得?4GB実機の料金と20ジョブを実測比較

RTX 4090 PC、AI API、XServer VPSのどれが得かを、4GB実機の公式料金とQwen3固定ジョブ20件で比較。電気・保守・償却・損益分岐の前提も整理します。
AI

Windows WDDMでnvidia-smiがN/A?XServer VPSでCPU・RAM・I/Oのサービス別計測を実験

Windows WDDMでnvidia-smiのプロセス別VRAMがN/Aになる悩みを検証。XServer VPSでCPU・RAM・I/Oをサービス別に16回測定し、帰属精度を実測します。
AI

Framework LaptopのUMA変更でOSが不安定?XServer VPSで256MB〜1GBのOOM隔離を実測

Framework LaptopのUMA変更でOSが不安定になる悩みを、XServer VPSの256MiB・512MiB・1GiB段階負荷で検証。コンテナOOMと公開API生存を実測します。
AI

RTX 5080でOllamaのVRAMが空かない?XServer VPSでkeep_alive 0秒・5分を実測

RTX 5080でOllamaのVRAMが空かない悩みを、XServer VPSのRAMで対照実験。keep_alive 0秒・5分の解放時間、常駐量、次回ロード時間を実測します。
AI

MacでOllamaが100% CPU?XServer VPSで実行アーキテクチャと推論バックエンドを実査

MacのOllamaがRosetta版やCPUフォールバックになっていない?XServer VPSでホスト、Docker、Ollama、llama-serverのアーキテクチャとCPUバックエンドを実査します。
AI

GPUなしPCでOllamaは遅い?XServer VPSで1・2・4スレッドの速度を実測

GPUなしのOllamaはどれくらい遅い?XServer VPS 4 vCPUでQwen3 0.6Bを1・2・4スレッド各3回実測し、tok/s、所要時間、CPU使用量、RAMを比較します。