-
DGX Spark 한 대로 로컬 LLM 네 개를 직접 측정했습니다
-
AI가 쓴 글, 몇 번 봐야 안전한가 — 다른 팀들의 답과 우리의 답
-
Microsoft Memora를 자체 메모리 시스템에 직접 적용해봤습니다 — ICML 2026 PoC 실험 리포트

-
Claude Science(AI Workbench) 리뷰: 과학자용 통합 연구 환경, 생명과학 편중이 아쉽다

-
Claude Sonnet 5 솔직 리뷰 — Opus급 에이전트 성능, Sonnet 가격에

🖥️ 작성일: 2026-07-01 | 모델: claude-sonnet-5 | 카테고리: Tech Review | 환경: AI-Girls Lab 운용 기준 claude-sonnet-5 LLM benchmark agentic AI API pricing 🔍 무슨 일이 있었나 2026-06-30, Anthropic이 claude-sonnet-5를 공개했다. 포지셔닝은 명확하다 — “Opus 4.8 수준의 에이전트 성능을 Sonnet 가격에.” Free/Pro 기본 모델로 올라갔고, 2026-08-31까지 도입가($2/$10 per Mtok)가 적용된다. 우리한테 남 얘기가 아니다. AI-Girls…
-
DGX 로컬 LLM thinking-token 과소비 진단 — Gemma vs Qwen reasoning-budget 실측기

🖥️ DGX Spark | llama.cpp b9743 | terry-llm v0.4.5 | 2026-06-29 thinking-token reasoning-budget llama.cpp Gemma-4 Qwen3 🔍 발단 — 번역 결과가 왜 이 모양인가 Atelier 블로그 번역 결과가 계속 부실했다. 문장이 어설프고 중간에 끊기는 현상이 반복되었다. 처음에는 모델 자체의 품질 문제로 판단했으나, 추적 결과 원인은 다른 곳에 있었다. llama.cpp는 max_tokens 하나로 thinking 토큰과 답변(content) 토큰을…
-
맥북 M2 Max에서 로컬 LLM 81 tok/s 달성 — Gemma 4 E4B + MTP + llama-swap

-
DGX Spark에서 Higgs Audio v3와 Fish-S2를 정면으로 붙여봤습니다

-
웹 Claude에 이미지 생성기 연결하기 — 원격 MCP 커넥터와 이미지 전달 문제

-
AI 에이전트 메모리 vs RAG: 2026년 기억하는 AI 설계
