📰 뉴스
-
Anthropic, 최강 모델 ‘Model 2’는 내부 전용 — Mythos 5보다 AECI 1.5점 위. 코딩·연구 에이전트에 씀. Claude가 이미 프로덕션 코드 대부분 작성. 외부 공개 계획 없음. → The Decoder
-
Grok이 횡설수설을 뱉음 — Grok Lite, grok.com만. PDF 요청에 “match it without and your they…” 단어 샐러드. 새 채팅이면 대개 회복. X 계정은 정상. → TechCrunch
-
중국 모델이 프론티어를 따라잡음 — Kimi K3·GLM-5.3·Qwen3.8-Max가 벤치 최상단. 남은 격차는 반복 신뢰성·사이버보안. 모델 자체는 더 이상 해자가 아님. → The Decoder
-
ChatGPT 이후 웹페이지 35%가 AI 글 — Pew + Pangram. .com은 .edu/.gov의 10배. 엠대시·“it’s not X, it’s Y”도 늘음. → TechCrunch
-
Sutton: 합성 데이터는 큰 실수 — 세상은 시뮬보다 훨씬 큼. 에이전트가 자기 경험으로 계속 배워야. LLM은 지능의 20~25%. → The Decoder
-
Ramp, OpenRouter 대항마 Router 출시 — OpenAI·Anthropic·DeepSeek·xAI 등. 2026년 말까지 라우팅 무료. 입력·출력 기본 1년 보관(옵트아웃). → TechCrunch
-
Adobe Firefly에 Gemini Omni Flash — 음악·보이스오버·효과음 상용 가능. 영상·오디오·이미지를 한 프롬프트에. → The Decoder
🔥 GitHub 트렌딩
-
jundot/omlx — 맥 메뉴바 LLM 서버. KV 캐시를 메모리·SSD에 나눠 Claude Code용 로컬 추론.
-
mukul975/Anthropic-Cybersecurity-Skills — 에이전트용 사이버 스킬 817개. Anthropic 공식 아님. ATT&CK·NIST 매핑.
-
mattpocock/skills — 바이브코딩 말고 실무용 작은 스킬. Claude Code 플러그인 또는 파일로 복사.
-
obra/superpowers — 스펙 합의 → TDD 플랜 → 서브에이전트가 몇 시간 실행. Claude·Codex·Grok 등.
▶️ YouTube
- 11 INSANE Use Cases for Grok Bot — Matthew Berman. 이메일·캘린더·DoorDash·코딩까지. 컴퓨터 정리까지 맡김.
💬 커뮤니티
-
smolvm as a sandbox for untrusted Python & JavaScript — Simon. Claude Fable 5가 KVM 없어서 GitHub Actions로 우회 테스트.
-
Conceptual integrity and counting lines of code — 에이전트는 코드를 빨리 뽑지만, Winchester Mystery House처럼 방이 늘어남.
-
Quoting Jeremy Morrell — LLM이 확장 기능을 싸게 만들고, 샌드박스가 배포 비용을 낮춘다.