タグ: #on-device-ai
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 3 件
llama.cppがブラウザに来た — WebGPUバックエンドが16台の実機で測った天井
UC Santa Cruzのチームが2026年5月に公開したLlamaWebは、llama.cppのWebGPUバックエンドであり、8ベンダーの実機16台でブラウザLLM推論を実測した、これまでで最も広いデータセットを残しました。結果は両面的です。既存のブラウザフレームワーク(WebLLM、Transformers.js)よりメモリを29〜33%少なく使い、デコードのスループットは45〜69%高い一方で、prefillはWebLLMの4
2026-07-16 · 29 分で読めます #webgpu#llm-inference#llama-cpp#on-device-ai#browserMac mini がオンデバイス AI マシンになった理由 — アップル半導体幹部インタビューが語ること、語らないこと
Apple Silicon のシニアプロダクトマネージャー、ダグ・ブルックス氏が The Deep View のインタビューで Mac mini と Mac Studio の需要とオンデバイス AI の方向性を語りました。開発者や小規模チームがなぜこの小さなデスクトップをローカル LLM・エージェント機として選ぶのか、統合メモリ構成の本当の利点は何か、そして CUDA エコシステムの差と直近の値上げという正直なトレードオフまで — 幹部
2026-07-11 · 10 分で読めます #apple-silicon#on-device-ai#local-llm#mac-mini#inference2026年のオンデバイスAI: あなたのスマートフォンが個人用AIサーバーになる時代
オンデバイスAIは2026年のモバイル革新の中心です。AppleのニューラルエンジンとSnapdragon AIにより、スマートフォンはプライバシー保護と極低遅延を同時に達成しながら、クラウド依存度を大幅に削減しています。
2026-03-16 · 12 分で読めます #on-device-ai#edge-inference#apple-intelligence#privacy#mobile-ai