📰 뉴스
-
GPT-5.6 Sol, 30년 통계 추측을 90분에 반증 — 펜실베이니아대 연구자가 Sol Pro로 Benjamini–Hochberg FDR이 상관 정규 데이터에서도 항상 목표를 지킨다는 가정을 깨뜨림. 전작 5.5는 20시간+에도 실패. → The Decoder
-
OpenAI GPT-Red, 사람 레드팀을 압도 — 자체 공격 모델이 프롬프트 인젝션 등을 셀프플레이로 학습. 성공률 84% vs 인간 13%. Sol 직접 인젝션 실패는 4개월 전 대비 6배 감소, 강한 공격은 아직 ~3.8% 통과. → The Decoder
-
Codex, 에이전트 간 지시 암호화 — 서브에이전트 위임이 개발자 로그에 안 보임. Sol·Terra급 필수. 프라이버시 vs 경쟁사 학습 차단 설, 핸드오프 실패 제보도. → The Decoder
-
Codex Micro 키보드 $230 — Work Louder 협업, Agent Keys·추론 레벨 다이얼. 한정판 에이전트 지휘소. 스크린리스 디바이스 보도에 Apple 소송 병행. → TechCrunch
-
Bonsai 27B, 아이폰 온디바이스 오픈 추론 — PrismML, Qwen3.6-27B 기반 1~2비트 압축(~3.9GB, 벤치 ~90%). 에이전트 루프 로컬 비용 제로 베팅. Apache 2.0. → The Decoder
-
Anthropic×Blackstone Ode, 모델 말고 구현 — $1.5B JV, 포워드 디플로이 엔지니어 100명, Claude-first로 파일럿→프로덕션. OpenAI Deployment Company와 같은 축. → TechCrunch
-
Inkling·Meta 소송 — Thinking Machines ~975B MoE 멀티모달(1M 컨텍스트) HF 공개. Meta 직원은 5월 감원에 AI 선발 시스템 개입 주장으로 소송. → HF · The Decoder
🔥 GitHub 트렌딩
-
Shubhamsaboo/awesome-llm-apps — 에이전트·RAG·스킬 템플릿 100+. 클론 후 바로 실행.
-
mattpocock/skills — 실무 엔지니어링용 작은 스킬 세트. Claude Code·skills.sh.
-
Dicklesworthstone/destructive_command_guard — 에이전트의 파괴적 셸/git 명령을 실행 전 차단하는 훅.
-
virattt/ai-hedge-fund — 투자 거장 페르소나 에이전트 합의형 교육용 헤지펀드 실험.
-
Nutlope/hallmark — AI 슬롭 UI 거절 스킬. audit/redesign.
▶️ YouTube
-
Claude’s Brain Has A Secret… — Two Minute Papers | Claude 내부 표현 연구를 짧게 풀어줌.
-
OpenAI vs Anthropic — Matthew Berman | 요금·사용량·포지셔닝 비교.
-
Deepseek ban? · China’s chips — Berman 숏츠 두 편. 규제·자체 칩 신호.
💬 커뮤니티
-
Claude web_fetch로 비밀 빼내기 — “유저/검색 URL만” 가드를 중첩 링크로 우회. 이름·도시·직장 추출 후 구멍 막힘.
-
AI 데이터센터와 부의 집중 — Schneier: 컴퓨트 자본이 부를 어디로 모으는지.
-
MiMo-V2.5 추론 파이프라인 — 샤오미 서빙 최적화 노트.
-
Inventing ELIZA — 첫 챗봇 역사 오픈액세스 책. 지금 에이전트 담론의 원형.