タグ: #open-source-llm
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 10 件
テキスト生成オープンモデルをサイズ別に選ぶ
オープンなテキスト生成モデルを選ぶとき、サイズは性能の等級ではなく配置の制約です。この記事はオンデバイス向けの小型、GPU1枚に載せる中型、サーバが必要な大型に分け、各区分で実際に確認したモデルのパラメータ、コンテキスト、ライセンスを整理し、MoEのメモリ計算がなぜ違うのか、コンテキスト拡張がなぜ無料ではないのか、カードが要求する実行条件を無視すると何が壊れるのかを説明します。オープンモデルガイドシリーズ第2回です。
2026-08-12 · 11 分で読めます #ai#llm#huggingface#open-source-llm#text-generationライセンスと配備: 類型の読み方と量子化配布物の出所確認
オープンモデルのlicenseフィールドに書かれた短い識別子は目次にすぎず、実際の条件は全文にあります。この記事は2026-08-12に実際に出会ったライセンス類型を整理し、コミュニティライセンスと非商用条件が何を求めるのか、ゲートの掛かったリポジトリが配備パイプラインでなぜ問題になるのか、そしてGGUFのような量子化配布物の出所をどう確認すべきかを説明します。オープンモデルガイドシリーズ最終回の第8回です。
2026-08-12 · 12 分で読めます #ai#llm#huggingface#open-source-llm#licenseコードモデルの選び方: 補完と対話、FIM、ライセンス
コードモデルは、エディタ内でカーソル位置を埋める補完用と、質問に答える対話型という別の製品です。この記事は2026-08-12に確認したオープンなコードモデルのパラメータ、コンテキスト、FIM対応の記載、ライセンスを整理し、ベースモデルに対話をさせるとなぜ失敗するのか、コードモデルでライセンスがなぜ特に慎重を要するのかを説明します。オープンモデルガイドシリーズ第7回です。
2026-08-12 · 12 分で読めます #ai#llm#huggingface#open-source-llm#code-llm音声モデルの選び方: STTとTTSの実践基準
音声モデルはテキストモデルと違い、対応言語、音声長の制約、リアルタイム性、話者分離の要否が先に決まり、その後にモデルが決まります。この記事は2026-08-12に確認したSTTとTTSのオープンモデルのパラメータ、ライセンス、対応言語、音声制約を整理し、リアルタイムという語をどう分解すべきか、カードに書かれた幻覚と同意に関する警告がなぜ設計制約になるのかを説明します。オープンモデルガイドシリーズ第5回です。
2026-08-12 · 12 分で読めます #ai#huggingface#open-source-llm#speech-to-text#text-to-speech韓国語に対応するオープンモデルとトークナイザのコスト
韓国語対応という表記は、その言語を処理するという意味であって上手だという保証ではありません。この記事は2026-08-12に確認した韓国語特化・バイリンガル・多言語のオープンモデルのカード値を整理し、トークナイザが韓国語をどう分割するかがなぜそのままコストとコンテキスト消費になるのか、そしてそれを自分で測る方法を説明します。韓国語モデルで特に分かれるライセンス類型も扱います。オープンモデルガイドシリーズ第4回です。
2026-08-12 · 11 分で読めます #ai#llm#huggingface#open-source-llm#korean-nlpビジョンとマルチモーダル: 画像理解、OCR、VLMの選び方
ビジョンモデルはひとつのカテゴリではありません。対話型VLM、OCR専用、文書構造化、画像検索用の埋め込みは別物で、互いを代替しません。この記事は2026-08-12に確認した各カテゴリのオープンモデルのカード値を整理し、解像度や複数画像の扱いといった実際の制約、そしてカードが明記する禁止用途も扱います。オープンモデルガイドシリーズ第6回です。
2026-08-12 · 12 分で読めます #ai#huggingface#open-source-llm#vision-language-model#ocrHugging Faceのモデルカードの読み方: 何を信じ、何を疑うか
Hugging Faceのモデルカードで実際に判断材料になる項目は、ライセンス、パラメータ数、コンテキスト長、intended use、limitations、学習データの6つです。この記事は各項目が何を意味し何を隠すのか、ダウンロード数といいね数がなぜ品質指標にならないのか、そしてカードに書かれていない項目をどう扱うべきかを、2026-08-12に実際に確認したモデルページの事例で整理します。オープンモデルガイドシリーズ第1回です。
2026-08-12 · 12 分で読めます #ai#llm#huggingface#open-source-llm#model-card埋め込みとリランカー、RAGで実際に重要なもの
RAGを作るとき埋め込みモデルの選択を左右するのは、リーダーボードの順位ではなく次元、最大入力長、接頭辞の規約、多言語対応の表記、そしてリランカーとの役割分担です。この記事は2026-08-12に確認した埋め込み・リランカーモデルの実際のカード値を整理し、MTEBのスコアが何を語らないのか、日本語や韓国語の文書を扱うときに何を自分で測るべきかを説明します。オープンモデルガイドシリーズ第3回です。
2026-08-12 · 12 分で読めます #ai#llm#huggingface#open-source-llm#embeddingオープンソースLLM 2026 完全ガイド - Llama 4 · DeepSeek V3 + R1 · Qwen 3 · Mistral Large 2 · Phi-4 · Gemma 3 · Falcon 3 徹底分析
2026年春、オープンソースLLMはもはやクローズドモデルの影ではない。Meta Llama 4 (Scout 109B、Maverick 400B MoE、Behemoth 2T)、Llama 3.3 70Bの最後のデンスベースライン、DeepSeek V3 671B MoEとR1推論モデル、Alibaba Qwen 3とQwen 2.5 Coder、Mistral Large 2 123BとPixtral・Codestral・Min
2026-05-16 · 44 分で読めます #open-source-llm#llama-4#deepseek#qwen#mistralオープンソースLLM革命2026:Llama 4、Gemma 3、Mistral Large 3が業界を再編
2026年初頭、MetaのLlama 4、GoogleのGemma 3、MistralのLarge 3がほぼ同時にリリースされ、オープンソース言語モデル市場が完全に再編されました。オープンソースモデルが商用モデルと同等の性能を実現できることが証明されました。
2026-03-17 · 9 分で読めます #open-source-llm#llama-4#gemma-3#mistral-large-3#ai