Qwen

TECH

LM StudioのWeb検索は実用になるのか?DuckDuckGo MCP × Gemma / Qwen / gpt-oss検証

LM StudioでローカルLLMにWeb検索を追加できるのか?DuckDuckGo MCPを使った実用検証。URL要約は本当に読めているのか、Gemma4・Qwen・gpt-ossの挙動差から見えた“決定的な違い”を解説。
TECH

ローカルASRの選び方 ─ 文字起こしはどれが最適か?Whisper・Moonshine・Qwen比較の結論、「Subtitle Editでいい」

ローカルで使える音声文字起こし(ASR)の選び方を整理。Whisper・Moonshine・Qwen・Cohereを実際に検証した結論として、なぜSubtitle Editが最も実用的なのかを解説します。
TECH

時間という次元に手を掛けたAI ─ Qwen3.5 Omniが示した「次の戦場」

Qwen3.5 Omniの登場は単なる機能追加ではない。AIが音声と動画を統合し「時間」を理解し始めたことで、検索から認識へと主戦場が移りつつある。次のAI時代の本質を解説する。
HowTo

Qwen3.5-9B(VLM)で免許証の本人確認(KYC)をOCRする─最小項目JSON抽出の現実解

ローカルVLM「Qwen3.5-9B」で運転免許証(表面)から本人確認に必要な最小3項目(氏名・生年月日・住所)だけをJSON抽出。安定化のコツと速度改善(縮小前処理)まで実測でまとめる。
TECH

“カメラとマイクがOSになる”UI革命の幕開け── Qwen 3 Omni Flash

序章──静かに訪れた“世界線の切り替わり”Qwen 3 Omni Flash のデモ映像を最初に見た瞬間、多くの人は「速い」「すごい」「Siriの上位互換?」といった、表面的な驚きで立ち止まってしまう。しかし本質はそこではない。これは、パソ...
HowTo

音声を英語字幕化してみた ─ Subtitle Edit+LM Studioで完全ローカル翻訳の実力検証

Whisper・LM Studio・Qwen3を組み合わせて字幕翻訳を実験。DeepLより遅いが、完全ローカルで処理できる価値がある。用途と結果をまとめたレビュー。関西弁の英日翻訳も。
TECH

Vision AI は「理解している」── Qwen-3-VL に写真を食わせたら、想像以上に“見えていた話”

Qwen-3-VL に写真を読み込ませたら、顔・名札・ナンバーなどの個人情報を理解していた。Vision AI は画像を「解析」ではなく「読解」する──その瞬間を記録したレポート。
TECH

Qwenは“見える”が“分かっていない” ─ Visionモデルの落とし穴と、危険な知識補完【Qwen 3-VL 実験レポート】

Qwen 3-VLは画像を正確に“見る”が、意味や知識を理解しているとは限らない。Vision推論で起こる「もっともらしい誤解」とハルシネーションの危険性を実例で解説。
HowTo

LM Studio × Qwen3-VL Vision推論─ローカルで写真を“自動タグ付け”する実装(HTML可視化付き)

LM Studio × Qwen3-VL でローカル Vision 推論を実装。画像を一括推論し、タグ・説明文・処理時間を HTML 可視化(report.html)するツール公開。JSONの地獄から卒業。
HowTo

LM Studio SDKで写真自動タグ付けを実現 ─ Vision推論は「Qwen3-VL」が「Gemma3」より4倍速かった

LM StudioでQwen 3-VL-4BとGemma-3-4b-itを同条件で比較。画像→説明→JSON化までのVision実行をp50/p95で速度計測。再現可能な手順・スクリプト・実務的な結論を提示。