태그: #hacker-news
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 14 편
Mistral OCR 4.1의 블록 단위 신뢰도 점수 — 문서 파이프라인에서 사람을 어디에 넣을지 정하는 값
Mistral이 OCR 4.1을 공개하면서 문단 단위 바운딩 박스와 구조 블록 레이블, 그리고 블록별 신뢰도 점수를 내놓았습니다. 문서 파이프라인을 만들어 본 사람에게 실제로 중요한 것은 셋째입니다. 신뢰도 점수가 있으면 전수 검토와 무검토 사이에 임계값이라는 선택지가 생기기 때문입니다. 그 임계값을 어떻게 정하는지, 신뢰도를 확률로 착각하면 무엇이 깨지는지, 그리고 페이지 단가 기준으로 자
2026-08-14 · 13 분 읽기 #ocr#document-ai#data-pipeline#human-in-the-loop#cost-optimization동형암호 컴파일러 HEIR과 비용이라는 조건 — 발표문에 없는 숫자를 댓글이 채운 사례
Google이 동형암호용 오픈소스 컴파일러 툴체인 HEIR을 공개했습니다. 여기서 진짜 뉴스는 암호가 아니라 컴파일러입니다. 지금까지 동형암호 배포를 막아 온 것은 수학이 아니라 암호 전문가만 할 수 있던 파라미터 선택 작업이었기 때문입니다. 다만 발표문은 오버헤드 수치를 하나도 제시하지 않았고, 그 빈칸을 이 분야를 연구한 댓글 작성자들이 채웠습니다. 어떤 워크로드가 이 기술의 적용 대상이
2026-08-14 · 14 분 읽기 #cryptography#privacy#compiler#machine-learning#securityDeepSeek Harness의 플러그인 커널 구조 — 되감을 수 있는 에이전트는 무엇이 다른가
DeepSeek이 공개한 오픈소스 코딩 에이전트 Harness는 모델도 도구도 UI도 전부 플러그인으로 만든 구조입니다. 그런데 실제로 흥미로운 부분은 플러그인이라는 단어가 아니라 두 가지 설계 결정입니다. 하나는 모든 실행을 추가 전용 이벤트 로그로 남겨 재개·분기·재생을 같은 스트림 위에서 처리한다는 것이고, 다른 하나는 플러그인 해제 시 부수 효과를 되돌리도록 강제한다는 것입니다. 이
2026-08-14 · 15 분 읽기 #ai-agent#architecture#plugin-system#observability#open-sourceQwen3.8-27B의 하이브리드 어텐션 — 64개 층 중 16개만 KV 캐시를 쌓는 구조
27B 모델이 26만 토큰 컨텍스트를 노트북에서 감당하는 이유는 파라미터 수가 아니라 층 구성에 있습니다. Qwen3.8-27B는 64개 층 중 48개를 선형 어텐션(Gated DeltaNet)으로, 16개만 일반 어텐션으로 배치해 KV 캐시가 자라는 층 자체를 4분의 1로 줄였습니다. 이 구조가 무엇을 아끼고 무엇을 잃는지, FP8 블록 양자화가 어디에 적용되는지, 그리고 로컬 추론을 검토
2026-08-14 · 15 분 읽기 #llm#inference#quantization#local-llm#attention분류하지 말고 지어내라는 기법과 그 검증 — 가짜 레이블이 원본 질의보다 나은 이유
수백 개짜리 분류 체계를 프롬프트에 넣는 대신, 작은 모델에게 그럴듯한 가짜 분류를 지어내게 하고 그것을 임베딩으로 실제 분류에 붙이는 기법이 논의됐습니다. 왜 이것이 동작할 수 있는지는 임베딩 공간의 비대칭성으로 설명됩니다. 다만 원문에는 측정 결과가 없고, 댓글에는 이 기법이 정말 원본 질의를 직접 임베딩하는 것보다 나은지 묻는 정확한 반론과 더 싼 대안이 함께 나왔습니다. 무엇을 어떻게
2026-08-14 · 13 분 읽기 #llm#embedding#classification#search#retrievalDRAM 주소 스크램블링과 보안 경계의 아래층 — 울타리가 번역보다 위에 있으면 생기는 일
CPU 안에서 가장 숨겨진 메모리 영역들을 DRAM 컨트롤러의 주소 변환을 흔들어 읽어 내는 연구 도구가 공개됐습니다. 취약점은 암호나 권한 검사에 있지 않습니다. 보호 울타리가 주소 변환보다 위층에 세워져 있다는 배치 자체에 있습니다. 이 구조가 왜 무너지는지, 별칭 주소를 GF(2) 위의 선형대수와 SMT 솔버로 어떻게 복원하는지, 그리고 이 연구가 실제로 무엇을 요구하고 무엇을 요구하지
2026-08-14 · 14 분 읽기 #security#hardware#memory#reverse-engineering#firmware이해가 병목이라는 주장과 그 순환 논리 — 설명을 생성한 쪽이 검증 대상일 때
에이전트가 코드를 만드는 속도가 사람이 읽는 속도를 넘어서면 무엇이 남는가를 다룬 글이 논의를 모았습니다. 저자는 검증을 위한 이해에서 참여를 위한 이해로 목표를 옮기자고 제안하고 세 가지 장치를 내놓습니다. 그런데 댓글에서 나온 가장 강한 반론은 그 설명 자체를 모델이 쓴다면 검증이 성립하느냐는 순환 지적이었습니다. 제안된 장치 중 어느 것이 이 반론을 견디고 어느 것이 견디지 못하는지 구
2026-08-14 · 13 분 읽기 #engineering-culture#code-review#developer-experience#documentation#ai-assisted-development657,607개의 링크를 따라가 본 결과와 URL 수명 — 링크는 왜 404가 아니라 연결 실패로 죽는가
2009년부터 2014년 사이에 만들어진 단축 링크 65만여 개를 2026년에 전부 따라가 본 조사가 공개됐습니다. 결과보다 중요한 것은 실패의 구성입니다. 죽은 링크의 대부분은 404가 아니라 연결 자체가 되지 않는 상태였고, 이는 내용이 옮겨진 것이 아니라 인프라가 사라졌다는 뜻입니다. 조사 방법의 한계까지 짚은 뒤에, 외부 URL을 데이터로 보관하는 시스템에서 무엇을 다르게 해야 하는지
2026-08-14 · 13 분 읽기 #web#data-engineering#archival#reliability#url-designGemini 3.7 Flash의 도입가와 3주 주기 — 모델 원가를 계약이 아니라 확률로 잡아야 하는 이유
Gemini 3.7 Flash 발표에서 실무자가 봐야 할 것은 벤치마크 상승폭이 아니라 두 가지입니다. 하나는 특정 날짜에 단가가 두 배로 오르는 도입가 구조이고, 다른 하나는 직전 모델이 3주 전에 나왔다는 사실입니다. 이 둘이 겹치면 모델 원가는 고정비가 아니라 만료일이 붙은 조건부 값이 됩니다. 공개된 벤치마크가 무엇을 비교하고 무엇을 비교하지 않는지, 그리고 발표에서 끝내 공개되지 않
2026-08-14 · 13 분 읽기 #llm#cost-optimization#benchmark#api-design#capacity-planningCerebras Ultrafast와 에이전트 루프의 병목 — 초당 750토큰이 줄이지 못하는 시간
Cerebras와 OpenAI가 초당 최대 750토큰을 내는 추론 티어를 공개했습니다. 발표문이 밝히는 원리는 연산량이 아니라 데이터 이동이고, 가중치를 웨이퍼 위 SRAM에 올려 두는 방식입니다. 왜 배치 1의 디코딩이 메모리 대역폭에 묶이는지, 발표된 배속 수치가 무엇을 재고 무엇을 재지 않는지, 그리고 토큰 생성이 빨라져도 줄지 않는 시간이 여러분의 에이전트 루프에서 몇 퍼센트인지 계산
2026-08-14 · 14 분 읽기 #llm#inference#hardware#latency#performance사이드 프로젝트 런칭 전략 2026 — Product Hunt·HN·X·Bluesky·Indie Hackers·뉴스레터 서킷까지 (심층 가이드)
주말에 만든 사이드 프로젝트를 어떻게 세상에 내놓을 것인가. Product Hunt는 식었고, Hacker News는 까다롭고, X는 알고리즘이 또 바뀌었고, Bluesky가 떠올랐다. 2026년의 채널별 런칭 플레이북을 — 사전 빌드, 런칭 당일, 사후 추적, 그리고 "대부분의 런칭은 아무 일도 일어나지 않는다"는 정직한 현실까지 — 한 호흡으로 정리한다.
2026-05-14 · 42 분 읽기 #side-project#product-launch#product-hunt#hacker-news#build-in-public글로벌 개발자 커뮤니티 가이드: Recurse Center부터 KubeCon, IndieHackers, Discord까지 (2026)
한국 개발자 커뮤니티 가이드의 자매편. 전 세계 개발자들이 모이는 리트릿, 컨퍼런스, 포럼, 챗 서버를 한 자리에 정리한다. Recurse Center, KubeCon, Strange Loop의 후예들, !!Con, DEF CON, FOSDEM, IndieHackers, Hacker News, Discord 커뮤니티 — 각각의 정체, 비용, 시간 투자, 어울리는 사람을 솔직하게 짚는다.
2026-05-14 · 43 분 읽기 #global-community#developer-community#recurse-center#kubecon#conferences개발자의 다음 커리어는 'Builder' — '엔지니어'가 저무는 시대, 무엇을 준비할 것인가 (2026)
Meta의 PM은 자신을 'AI builder'라 부르고, LinkedIn은 'full stack builder' 프로그램을 열었고, Walmart의 'agent builder' 자리는 비개발 직원이 채웠다. Anthropic Claude Code 제작자는 '코딩은 사실상 풀렸고 소프트웨어 엔지니어라는 타이틀은 사라질 것'이라 말한다. GeekNews와 Hacker News를 뒤져 정리한,
2026-05-14 · 23 분 읽기 #career#builder#ai-era#developer-career#vibe-coding2025 IT 기술 트렌드 총정리: 해커뉴스에서 가장 뜨거웠던 기술과 개발자 인사이트
2025년 가장 뜨거운 IT 트렌드! AI Agent/MCP 혁명, Rust의 부상, WebAssembly 2.0, Edge Computing, Local-first 소프트웨어, 오픈소스 라이선스 논쟁, 개발자 도구 혁신, 스타트업 동향, 빅테크 전략 — 해커뉴스 핫토픽 분석.
2026-03-25 · 38 분 읽기 #tech-trends#hacker-news#ai#rust#webassembly