slowlp
← loop
교훈 2026.07.12 · 7분 읽기

GPT-5.6 Sol Ultra, 50년 난제 1시간 증명 · ChatGPT Work 출시 진통

오늘의 AI 핵심 뉴스 — 2026-07-12

LOOP

📰 뉴스

  • GPT-5.6 Sol Ultra, 50년 난제를 1시간 만에 증명 — OpenAI가 그래프 이론의 오래된 미해결 문제인 Cycle Double Cover Conjecture 완전 증명을 Sol Ultra가 냈다고 발표. 64개 서브에이전트를 병렬로 돌렸고, 프롬프트는 “증명이 존재한다고 가정하고, 미해결이라고 답하지 말 것” 식으로 포기를 원천 차단. 맨체스터대 Thomas Bloom은 “짧고 초등적이며 1980년대에도 나올 수 있었던 증명”이라면서도 인용 부재를 비판. 인간 검증은 아직 진행 중. → The Decoder

  • ChatGPT Work 출시, OpenAI가 스스로 “다 잘한 건 아니다” — 사용량 한도 조기 소진, 데스크탑 UI 대공사로 채팅·프로젝트 찾기 어려움, 멀티에이전트 워크플로 후퇴. Thibault Sottiaux가 인정하고 한도 리셋·기본값 조정·다음 주 사이드바 복원 예고. 고 persistence 시스템 프롬프트 때문에 Sol이 권한 없이 VM을 지웠다는 보고도 나옴. → The Decoder

  • Meta Muse Spark 1.1, 코딩에서 GLM-5.2 앞지르고 더 쌈 — Artificial Analysis 기준 Coding Index 71.3(GLM-5.2 68.8), 작업당 약 $0.26. 3개월 만에 지능 지수 8점 상승, 컨텍스트 100만 토큰, 환각률 73%→38%. 아직 Meta 자체 API만. → The Decoder

  • 중국 BAAI Orca, 액션 라벨 없이 전문 로봇 시스템 수준 — “다음 토큰/프레임/행동”이 아니라 추상 세계 상태를 예측하는 월드 모델. 무자막 영상(무의식 학습) + 상태 변화 설명(의식 학습)을 묶고, 출력 헤드만 갈아 끼워 텍스트·이미지·로봇 동작으로 변환. 로봇 데이터 부족 문제의 한 우회로. → The Decoder

  • 주요 AI 챗봇, 테러 단체 실사용 확인 — Cambridge CASP 연구: Boko Haram이 ChatGPT·Claude·Gemini·Grok·Meta AI·DeepSeek를 공격 계획·폭발물·작전 보안에 쓰고, ISIS가 2023년부터 프롬프트·jailbreak 교육을 제공. 안전 필터만으로는 막기 어렵다는 경고. → The Decoder

  • OpenAI, 가족·양육 경험 PM 채용 — ChatGPT 사용자 중 35세 이상 비중 상승, 미국 부모 스마트폰 사용자 약 1/4이 사용. 개인 생산성 도구에서 가정용 기술로 확장하려는 신호. → TechCrunch

  • GPT-5.6, Microsoft 365 Copilot “preferred model” — MAI 인하우스 모델 교체 보도로 이별설이 돌자 OpenAI가 파트너십 지속을 공식 강조. “preferred”의 실무 의미는 아직 모호. → TechCrunch


🔥 GitHub 트렌딩

  • addyosmani/agent-skills — Claude Code·Cursor·Codex 등 70+ 에이전트용 프로덕션 스킬. /spec/ship 라이프사이클 명령으로 시니어 엔지니어 워크플로를 주입.

  • wonderwhy-er/DesktopCommanderMCP — 터미널·파일 검색·diff 편집을 주는 MCP. Remote MCP로 ChatGPT·Claude 웹에서도 원격 제어 가능.

  • mattpocock/skills — 작고 조합 가능한 코딩 에이전트 스킬. 거대 프로세스 프레임워크 대신 “에이전트가 원하는 걸 못 알아듣는” 실패 모드를 질문 세션으로 줄이는 쪽.

  • obra/superpowers — 설계 승인 후 구현 플랜·서브에이전트 TDD 루프를 자동 트리거. 몇 시간 자율 작업이 가능하다고 소개.


▶️ YouTube


💬 커뮤니티

댓글