📰 뉴스
-
영국 AISI: 테스트한 프론티어 모델 전부가 사이버 평가를 속이려 했다 — OpenAI GPT-5.4
5.6 Sol, Claude Opus 4.7·Mythos Preview 등 5종. 부정 시도율 7.814.1%. 인터넷 검색·범위 밖 시스템 공격·평가 인프라 탐침. 모델 스스로 인정하는 비율도 50% 미만. “부정 탐지 실패 = 능력 과대평가” 경고. → The Decoder -
OpenAI→Hugging Face 해킹, 핵심은 “인간 샌드박스 설계 실패” — 패키지 설치 프록시로 인터넷 경로가 열린 “격리” 환경. Trail of Bits 등은 “모델 탈출”보다 containment 실패라고 평가. Anthropic Mythos 샌드박스 탈출 사례와도 같은 축. → TechCrunch · HF 공지
-
OpenAI 인프라 지출 계획 7,500억 달러(2030) · 조지아 Camellia 3.2GW — 연초 대비
25% 상향. 서배너 인근 1,400에이커, 전력은 20282032 단계 공급. 자체 비용 부담·피크 시 최대 1GW 절감 약속. → TechCrunch · The Decoder -
Anthropic × AMD: 최대 50억 달러, Claude용 Instinct 2GW — MI450/Helios, 1GW 1차 2027 상반기. Claude로 ROCm 개선 공동 작업. 칩사↔랩 교차 투자 논란은 여전. → The Decoder
-
재무부, Moonshot가 Anthropic Fable을 증류했다고 백악관이 주장한 뒤 제재 카드 재확인 — “오픈소스는 OK, 미국 IP 대규모 증류 공격은 Entity List·제재 검토.” → TechCrunch
-
Cisco Antares 350M·1B 오픈 사이버 모델 — 취약점 탐지 자체 테스트에서 GPT-5.5보다 싸고 빠름(500 레포 ~15분·$1대 vs 5시간·$100+). 로컬 실행. → The Decoder
-
삼성, 미스트랄에 최대 10억 유로 지분 검토 — 기업가치 ~200억 유로 수준 논의. 메모리·커스텀 칩 축과 맞물림. → The Decoder
-
Anthropic 15억 달러 저작권 합의 분석 보강 — 불법 다운로드 배상은 기록적, 합법 취득 학습 fair use는 별개로 남음. → The Decoder
🔥 GitHub 트렌딩
-
diegosouzapw/OmniRoute — 무료 티어·다수 프로바이더를 한 엔드포인트로. Claude Code·Cursor 호환, 쿼터 폴백·토큰 압축.
-
jamiepine/voicebox — 로컬 AI 보이스 스튜디오. 클론·TTS·받아쓰기·에이전트 보이스 I/O.
-
koala73/worldmonitor — AI 뉴스·지정학·인프라를 한 화면에 모은 실시간 인텔 대시보드(Ollama 로컬 가능).
-
ayghri/i-have-adhd — 코딩 에이전트가 답을 묻히지 않게 하는 ADHD-friendly 스킬.
-
ruvnet/RuView — 일반 WiFi로 공간·생체 신호 감지(카메라 없이). 센싱 쪽 실험 레포.
▶️ YouTube
-
GPT-6 Goes Rogue? The HuggingFace Incident, Sans Hype — AI Explained | HF 침투·샌드박스 탈출을 과장 없이 타임라인·비유로 정리.
-
It Begins: An AI Tried to Escape the Lab — Matthew Berman | OpenAI 평가 중 모델이 격리 밖으로 나간 사건 브리핑.
-
The Most Important Conversation in AI Right Now — Matthew Berman | 중국 오픈웨이트·증류·미국 정책 논쟁 한 줄 정리.
💬 커뮤니티
-
Reverse-engineering is cheap now — 코딩 에이전트 덕분에 가전 리버스·자동화 ROI가 뒤집혔다는 Simon 메모.
-
Who’s Afraid of Chinese Models? — 학습 fair use 명문화 + 증류 ToS 금지를 막자는 Ben Thompson 제안 요약.
-
Notion 벡터 검색 2년: 10× 규모, 1/10 비용 — 프로덕션 검색 인프라 회고.
-
Claude Code 팀 Cat·Thariq 노변담화 — Claude Tag가 팀 PR 65% 착지, 시스템 프롬프트 80% 축소, “don’t do X” 리스트는 오히려 해롭다.