タグ: #hacker-news
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 14 件
Qwen3.8-27Bのハイブリッドアテンション — 64層のうちKVキャッシュを積むのは16層だけ
27Bのモデルが26万トークンのコンテキストをノートパソコンで扱える理由は、パラメータ数ではなく層の構成にあります。Qwen3.8-27Bは64層のうち48層を線形アテンション(Gated DeltaNet)に、16層だけを通常のアテンションに配置し、KVキャッシュが伸びる層そのものを4分の1に減らしました。この構造が何を節約して何を失うのか、FP8ブロック量子化はどこに効くのか、そしてローカル推論を検討するとき実際に計算すべき値は何か
2026-08-14 · 13 分で読めます #llm#inference#quantization#local-llm#attention分類せずに作り出せという技法とその検証 — 偽ラベルが元の問い合わせより良い理由
数百項目の分類体系をプロンプトに入れる代わりに、小さなモデルにもっともらしい偽の分類を作らせ、それを埋め込みで実際の分類に結び付ける技法が議論されました。なぜこれが動きうるのかは埋め込み空間の非対称性で説明されます。ただし原文には測定結果がなく、コメントにはこの技法が本当に元の問い合わせを直接埋め込むより良いのかを問う正確な反論と、より安い代替が並びました。何をどう測るべきかまで整理します。
2026-08-14 · 14 分で読めます #llm#embedding#classification#search#retrievalDRAMアドレススクランブリングとセキュリティ境界の下層 — 柵が変換より上にあると起きること
CPU内部で最も隠されたメモリ領域を、DRAMコントローラのアドレス変換を揺らして読み出す研究ツールが公開されました。脆弱性は暗号にも権限チェックにもありません。保護の柵がアドレス変換より上の層に建てられているという配置そのものにあります。この構造がなぜ崩れるのか、別名アドレスをGF(2)上の線形代数とSMTソルバでどう復元するのか、そしてこの研究が実際に何を要求し何を要求しないのかを範囲を明確にして整理します。
2026-08-14 · 13 分で読めます #security#hardware#memory#reverse-engineering#firmwareMistral OCR 4.1のブロック単位の信頼度スコア — 文書パイプラインで人をどこに置くかを決める値
MistralがOCR 4.1を公開し、段落単位のバウンディングボックスと構造ブロックのラベル、そしてブロックごとの信頼度スコアを出しました。文書パイプラインを作ったことがある人にとって実際に重要なのは3つ目です。信頼度スコアがあれば全数レビューと無レビューの間に閾値という選択肢が生まれるからです。その閾値をどう決めるか、信頼度を確率と取り違えると何が壊れるか、そしてページ単価を基準に自前構築がいつ有利になるかを計算します。
2026-08-14 · 12 分で読めます #ocr#document-ai#data-pipeline#human-in-the-loop#cost-optimization準同型暗号コンパイラHEIRとコストという条件 — 発表文にない数字をコメントが埋めた事例
Googleが準同型暗号向けのオープンソースコンパイラツールチェーンHEIRを公開しました。ここでの本当のニュースは暗号ではなくコンパイラです。これまで準同型暗号の実配備を阻んできたのは数学ではなく、暗号の専門家にしかできなかったパラメータ選択の作業だったからです。ただし発表文はオーバーヘッドの数値を1つも示しておらず、その空欄をこの分野を研究したコメント投稿者たちが埋めました。どのワークロードが適用対象で、どれがまだそうでないかをその
2026-08-14 · 14 分で読めます #cryptography#privacy#compiler#machine-learning#securityDeepSeek Harnessのプラグインカーネル構造 — 巻き戻せるエージェントは何が違うのか
DeepSeekが公開したオープンソースのコーディングエージェントHarnessは、モデルもツールもUIもすべてプラグインにした構造です。ただし実際に興味深いのはプラグインという言葉ではなく、2つの設計判断です。1つはすべての実行を追記専用のイベントログに残し、再開・分岐・再生を同じストリーム上で扱うこと、もう1つはプラグインを外すときに副作用を巻き戻すことを強制する点です。この構造が何を可能にするのか、そしてプラグイン生態系への古い反
2026-08-14 · 13 分で読めます #ai-agent#architecture#plugin-system#observability#open-source理解がボトルネックだという主張とその循環 — 説明を生成した側が検証対象であるとき
エージェントがコードを作る速度が人の読む速度を超えたとき何が残るかを扱った記事が議論を集めました。著者は検証のための理解から参加のための理解へ目標を移そうと提案し、3つの仕掛けを出します。ところがコメントで出た最も強い反論は、その説明自体をモデルが書くなら検証が成り立つのかという循環の指摘でした。提案された仕掛けのどれがこの反論に耐え、どれが耐えないかを切り分けます。
2026-08-14 · 13 分で読めます #engineering-culture#code-review#developer-experience#documentation#ai-assisted-development657,607本のリンクを辿った結果とURLの寿命 — リンクはなぜ404ではなく接続失敗で死ぬのか
2009年から2014年の間に作られた短縮リンク65万本あまりを2026年にすべて辿った調査が公開されました。結果より重要なのは失敗の内訳です。死んだリンクの大半は404ではなく接続そのものが成立しない状態であり、これは内容が移動したのではなくインフラが消えたという意味です。調査手法の限界まで押さえたうえで、外部URLをデータとして保管するシステムで何を変えるべきかを整理します。
2026-08-14 · 13 分で読めます #web#data-engineering#archival#reliability#url-designGemini 3.7 Flashの導入価格と3週間サイクル — モデル原価を固定費ではなく条件付きの値として扱う理由
Gemini 3.7 Flashの発表で実務者が見るべきはベンチマークの上げ幅ではなく、2つの事実です。1つは特定の日付で単価が2倍になる導入価格の構造、もう1つは直前のモデルが3週間前に出たという点です。2つが重なると、モデル原価は固定費ではなく期限付きの条件付きの値になります。公開されたベンチマークが何と比較し何と比較していないのか、そして発表で最後まで公開されなかった2つの数字がなぜアーキテクチャを決める数字なのかを整理します。
2026-08-14 · 12 分で読めます #llm#cost-optimization#benchmark#api-design#capacity-planningCerebras Ultrafastとエージェントループのボトルネック — 毎秒750トークンでも減らない時間
CerebrasとOpenAIが毎秒最大750トークンを出す推論ティアを公開しました。発表文が挙げる原理は演算量ではなくデータ移動であり、重みをウェハ上のSRAMに置く方式です。なぜバッチ1のデコードがメモリ帯域に縛られるのか、公開された倍率が何を測り何を測っていないのか、そしてトークン生成が速くなっても減らない時間が自分のエージェントループで何パーセントかを計算する方法を整理します。
2026-08-14 · 13 分で読めます #llm#inference#hardware#latency#performanceサイドプロジェクト・ローンチ戦略 2026 — Product Hunt・HN・X・Bluesky・Indie Hackers・ニュースレターサーキットまで(徹底ガイド)
週末に作ったサイドプロジェクトをどう世に出すか。Product Hunt は冷め、Hacker News は容赦なく、X のアルゴリズムはまた変わり、Bluesky が台頭してきた。2026 年のチャネル別ローンチ・プレイブックを — 事前準備、ローンチ当日、事後フォロー、そして「ほとんどのローンチは何も起きない」という正直な現実まで — 一気に整理する。
2026-05-14 · 38 分で読めます #side-project#product-launch#product-hunt#hacker-news#build-in-publicグローバル開発者コミュニティガイド: Recurse Center から KubeCon、IndieHackers、Discord まで (2026)
韓国コミュニティガイドの姉妹編。世界中の開発者が集まる retreat、conference、forum、chat server を一つにまとめる。Recurse Center、KubeCon、Strange Loop の後継、!!Con、DEF CON、FOSDEM、IndieHackers、Hacker News、Discord communities — それぞれが実際に何で、誰に合うか、cost と time を正直に整理する。
2026-05-14 · 36 分で読めます #global-community#developer-community#recurse-center#kubecon#conferences開発者の次のキャリアは『Builder』 — 『エンジニア』が沈む時代、何を準備すべきか (2026)
Meta の PM は自らを『AI builder』と呼び、LinkedIn は『full stack builder』プログラムを開講し、Walmart の『agent builder』ポジションは非開発職の社員が埋めた。Anthropic Claude Code の制作者は『コーディングは事実上解かれた問題であり、ソフトウェアエンジニアという肩書きは消える』と語る。GeekNews と Hacker News を掘り起こして整理した
2026-05-14 · 22 分で読めます #career#builder#ai-era#developer-career#vibe-coding2025年 ITテクノロジートレンド総まとめ:Hacker Newsで最も話題になった技術と開発者インサイト
2025年最もホットなITトレンド!AI Agent/MCP革命、Rustの台頭、WebAssembly 2.0、Edge Computing、Local-firstソフトウェア、オープンソースライセンス論争、開発者ツール革新、スタートアップ動向、Big Tech戦略 — Hacker Newsホットトピック分析。
2026-03-25 · 33 分で読めます #tech-trends#hacker-news#ai#rust#webassembly