Otama's Playground - インフラ、Kubernetes、AI などの技術ブログ
インフラ、Kubernetes、AI などの技術ブログ
『自閉症の脳を読み解く』を読んで、自分の脳に折り合いをつける
自分の生きづらさや考え方の癖はどこから来るのか。『自閉症の脳を読み解く』を読んで整理しました。
『マッピング思考』を読んで、自分の考えから少し離れてみる
人の相談なら冷静に答えられるのに、自分のことになると理由が増える。『マッピング思考』から、考えを一歩離れて見るための問いを拾いました。
『多動脳』を読んで、集中するための条件を見直した
注意散漫は意志の弱さだけで決まらない。『多動脳』を読み、報酬系、ハイパーフォーカス、運動の話から、自分が集中できる条件を考え直しました。
『予想どおりに不合理』読書メモ:なぜ「それ」を選んでしまうのか
無料、アンカー、保有効果。『予想どおりに不合理』全15章の要点を、日常の心当たりと一緒にざっくり振り返ります。
AI時代にこそ読みたい『スマホ脳』:アナログな脳を守るマイルール
AIとスマホに思考を預けすぎないために。『スマホ脳』から、エンジニアが集中力とメンタルを守る現実的な習慣を考えます。
Claude Code スキルで、おうちk8sの自律デバッグ・チューニングができるようになった話
Claude Code の allowed-tools スキルで、homelab k3s クラスターの診断・修復・LLM 推論チューニングを自動化した話。圧縮閾値の迷走とツール削減を経て、実使用 TPS が 21 t/s から 32+ t/s になった。
ARC self-hosted runner で homelab 内部サービスを GitHub Actions から叩く
GitHub-hosted runner からはアクセスできない homelab 内部のサービスに、ARC (Actions Runner Controller) の self-hosted runner を K8s に立てることで GitHub Actions から直接到達できるようにした話。
AMD GPU + LiteLLM でローカル LLM と ChatGPT を同じエンドポイントに束ねた
AMD Radeon で動く Lemonade サーバーと ChatGPT サブスクリプションを LiteLLM Proxy で束ねて OpenAI 互換 API に統一した話。opencode との組み合わせも検討中。
Copilot Chat の utility model をローカル LLM に切り替えた話
VS Code Copilot Chat の commit メッセージ生成などに使われる utility model を、LiteLLM 経由の Gemma-4-E4B に切り替えて GitHub Copilot のクォータを温存した話。
Strix HaloでLLMを動かすまでの地獄 — MESファームウェア 0x83バグとの3日間
Ryzen AI MAX+ 395のk3s + AMD GPU構成でllama.cppを動かそうとしたらMemory access faultに遭遇。ROCmアップグレードでは直らず、たどり着いた真犯人はMESファームウェア 0x83のバグだった3日間の記録。
Incus VMでGPUパススルーを試みた結果、ベアメタルに逃げた話
Strix Halo(AMD Ryzen AI MAX+)をIncus VM + VFIOでk3sワーカーにしようとして、GPU dirty状態から回復できないという壁に当たりました。結局ベアメタルに落ち着くまでの話です。