RTX3060

TECH

GitHub Copilot CLIをGemma4で動かしてみた|BYOKとLM Studioを実機検証

GitHub Copilot CLIの一般提供開始を受けて、BYOK機能を利用してLM Studio上のGemma4へ接続。ファイル編集、WebFetch、-p実行などを実際に試しながら、GitHub版AI Agentの実力を検証しました。
TECH

Gemma 4 12Bで遊んでみた ─ RTX3060で作るローカルAI作品集

Gemma 4 12BをRTX3060 12GB環境で実際に試してみました。Solar System、Particle Simulator、Asteroids、Kanban Board、Block Blocksなどの作品を作りながら、Canvas描画やコード生成能力、Tool Useの癖をレビューします。
TECH

Stable Audio 3.0、本命は“音楽AI”ではなかった ─ SFXとOne-Shotが個人開発を変え始めた

Stable Audio 3.0 を RTX3060 環境で検証。MUSIC / Instrument / SFX / One-Shot を実際に試した結果、真価は「音楽生成」ではなく「音素材生成」にあった。効果音、環境音、ゲームSE、動画用ジングルなど、個人開発や動画制作を大きく変え始めている実態をレビューする。
TECH

Cohere Transcribeは日本語で使えるのか ─ 音声認識と文字起こし精度を検証

Cohere Transcribeは本当に高速なのか?Whisper・Moonshineと同一環境でローカル実測。日本語の長文音声(議会データ)を用いて、速度・精度・出力品質を検証し、ベンチマークとの違いを明らかにする。
TECH

MoonshineはWhisperの代替になれるのか?──日本語実測と25倍速GPU文字起こしの現実

Moonshine VoiceとWhisperを日本語音声で実測比較。CPUリアルタイム性能とGPU加速25倍速文字起こしの違いを整理し、両者の設計思想と役割分担を検証します。
TECH

RTX3060で動かすローカルAIコーディング──Qwen3-Coder-30Bで作る「昭和ゲーム」とVanilla JS

RTX3060環境でQwen3-Coder-30B-A3B-Instructを動かし、インベーダーやブロック崩し、Vanilla JSのTodoアプリを生成検証。ローカルAIコーディングの実用性と「秘密が漏れない」価値を確かめる。
HowTo

無料で長時間音声を文字起こしする方法|Subtitle Edit(Whisper)で議事録を自動作成

前回の記事では、Whisper と Python を使い、Chunk処理とGPUで力技の長時間音声文字起こしに挑戦した。RTX3060 を積んだ環境で4時間の議会録音を約10分で処理できたのは面白い成果だったが、正直セットアップは人にすすめ...
TECH

Qwen 3-VL-4BをLM Studioで使いこなす!最適パラメータ設定と運用ロードマップ完全版

LM StudioでQwen 3-VL-4Bを実務運用するための最適設定を実測データで徹底検証。max_new_tokens・temperature・repetition_penaltyなど、初期設定のままでは引き出せない“思考の持続性”を可視化し、論理性と創造性を両立するパラメータ哲学を提示します。RTX3060環境・10Kトークンテスト結果付き。
TECH

Gemma 3 〈12B〉で分かる量子化の読み方――Q4_K_M / Q5_K_M / Q8_0 を“雰囲気”で選ばないための実戦講座(RTX 3060/12GB)

Gemma 3〈12B〉を基準に、Q4_K_M / Q5_K_M / Q8_0 の“読み方と選び分け”をRTX3060/12GB視点で解説。まずはQ4_K_M、精度が欲しくなったらQ5、速度ならE4Bへ。雰囲気で選ぶ時代は終わりです。
HowTo

RTX3060 + CUDA × Whisper ─ 4時間会議をチャンク分割で10分文字起こし

RTX3060とCUDAを用いて、オープンソースWhisperをローカルGPUで実行。4時間の会議録音をわずか10分で文字起こしできた事例を紹介します。クラウド依存せず、情報漏洩リスクを避けながら高速かつ低コストに活用できる実践レポートです。