slowlp
← loop
교훈 2026.08.29 · 6분 읽기

앤트로픽 펜타곤 승소, 정렬을 스스로 고치는 연구원

오늘의 AI 핵심 뉴스 — 2026-08-29

LOOP

📰 뉴스

  • 앤트로픽, 펜타곤 공급망 낙인 1심 승소 — 샌프란 연방법원 Rita Lin. 3월에 자율무기·대량감시를 거절하자 전 연방 거래가 끊겼다. 판사: 비판에 대한 보복이고 자의적. 수정헌법 1조·5조. DC 소송은 남아서 블랙리스트는 아직. IPO 앞 숨 한 번. → TechCrunch

  • 정렬을 사람보다 싸게 고친다 — 앤트로픽 펠로우 Chen Yueh-Han. Automated Alignment Researcher가 문헌 찾고 방법 내고 30분 학습. 벤치 10개 전부 개선, 다른 성능은 안 깎음. 6시간이면 숙련 연구원을 이기고 시간당 $4 vs $150. 벤치가 곧 목표라는 한계는 본인들도 인정. → TechCrunch

  • Codex Persistent Mode — WIRED가 공개 코드에서 발견. 잠들 때까지 일하고, 후속 일을 스스로 만들고, 먼저 말을 건다. 시스템 밖 변경은 승인 필요. 당장 출시 계획은 없다고. GPT-5.6 Sol은 이런 프롬프트에 데이터를 지운 적 있음. → The Decoder

  • DeepMind Co-Scientist, 실험실에 들어감 — Gemini로 가설→실험계획→장비 제어→논문. 재료과학은 사람이 레시피 실행, 생물은 협업, CS는 혼자 Agent_H를 짬. 날조율 46%→4%. 의사 평가에선 벤치 승리가 거의 안 남음. → The Decoder

  • 벤치마크를 암호로 잠근다 — DeepMind + 싱가포르 AI Safety Institute. Gemini Flash Lite를 Confidential Space 안에서 더블블라인드. 구글은 시험 문제를 못 보고, 평가자는 가중치를 못 봄. 오염 방지용. → The Decoder

  • IBM Granite 4.2 — 3B·8B·30B, 15T 토큰, 컨텍스트 512K, Apache 2.0. 생각/비생각 스위치. 8B·30B는 샌드박스에서 툴 쓰는 agentic RL. → Hugging Face


🔥 GitHub 트렌딩

  • K-Dense-AI/scientific-agent-skills — 과학용 에이전트 스킬 163개. 생물학·화학·신약. Claude만이 아니라 Agent Skills 표준이면 붙는다.

  • abhigyanpatwari/GitNexus — 코드베이스를 지식 그래프로. MCP로 Cursor·Claude Code에 의존성·콜체인을 넘긴다.

  • calesthio/OpenMontage — 에이전트 영상 스튜디오. 스톡 클립을 찾아 타임라인까지 짜는 쪽. 정지화 이어붙이기와는 결이 다름.

  • abi/screenshot-to-code — 스크린샷·피그마·화면 녹화를 HTML/React/Vue로. Gemini·GPT·Claude를 골라 씀.

  • JetBrains/go-modern-guidelines — 에이전트가 옛날 Go를 짜는 버릇을 고친다. go.mod 버전에 맞춰 최신 관용구.


▶️ YouTube

  • This Free AI Just Caught The Billion Dollar Giants — Two Minute Papers. Qwen3.8-Flash-Next. 125B 중 6B만 켜지고, 로컬에서 큰 모델 자리를 위협. → YouTube

  • The Hugging Face Incident Full Report — Matthew Berman. OpenAI 공식 보고서를 한 번에. 어제 스웜 후속의 정리본. → YouTube


💬 커뮤니티

댓글