Anthropic 약자가 강자를 고친다: Anthropic이 정렬을 에이전트에게 맡긴 이유 Anthropic은 2026년 8월 28일 Claude 에이전트가 정렬 실패 10가지를 스스로 고치는 연구를 공개하고, 그 하네스를 오픈소스로 풀었다. 약한 Claude Sonnet 5가 60시간 만에 강한 Opus 4.8 초기의 정렬 점수를 출시본에 가깝게 끌어올렸다.
Anthropic 소켓을 하드웨어까지: Anthropic이 MHS로 실험실을 연 이유 Anthropic은 2026년 8월 27일 AI 에이전트가 현미경·액체 핸들러·로봇 팔을 안전하게 다루는 Model Hardware Standard(MHS) 연구 미리보기를 열었다. MCP가 데이터·도구 소켓이었다면, MHS는 물리 장비 소켓을 먼저 표준으로 잡겠다는 선택이다.
Qwen 켜는 건 6B뿐이다: Qwen이 Flash-Next로 Qwen4를 먼저 연 이유 알리바바 Qwen 팀은 2026년 8월 26일 Qwen4를 받칠 아키텍처의 실험 미리보기 Qwen3.8-Flash-Next를 오픈 웨이트로 풀었다. 125B 중 실제로 켜지는 건 6B이고, 긴 컨텍스트 비용을 구조로 줄이겠다는 설계다.
오픈소스 희소 MoE를 건너뛰다: IBM이 Granite 4.2를 밀집 추론으로 낸 이유 2026년 8월 25일 IBM은 Granite 4.2를 3B·8B·30B 밀집 추론 모델로 Apache 2.0 공개했다. thinking 스위치와 8B·30B의 실제 샌드박스 에이전트 RL이 핵심이고, 같은 날 Speech 5.0 Turbo CTC(470M)도 나왔다.
AI 뉴스 탭은 네 것, 브라우저는 둘이다: Claude가 Chrome과 Cowork를 가른 이유 Anthropic은 2026년 8월 26일 Claude in Chrome을 유료 전 요금제에 정식 열고, 같은 날 Cowork에 확장 프로그램 없이 쓰는 내장 브라우저를 올렸다. 내 로그인 탭과 Claude 전용 브라우저를 가르고, 자동 승인 앞에는 안전 분류기를 앉혔다.
AI 뉴스 큰 모델이 먼저 안 왔다: GLM-5.3-Flash가 MIT로 풀린 이유 어제 Hugging Face에 앉은 건 플래그십 GLM-5.3이 아니라 Flash다. 320B 중 18B만 켜고 MIT로 가중치가 풀렸고, 플래그십 행은 아직 GitHub 다운로드 표에 없다.
AI 뉴스 다시 학습하지 않는다: DeepMind가 트랜스포머에 되먹임을 넣은 이유 Google DeepMind와 UT Austin은 기성 Gemma 3 가중치를 건드리지 않고, 깊은 층 활성화를 얕은 층으로 되먹이는 재순환을 올렸다. 적응형은 퍼플렉서티를 평균 23% 낮추고 GSM8k 정확도를 21% 올렸다고 초록은 적으며, 생성 지연은 거의 그대로다.
AI 뉴스 남의 칩만 쓰던 집이 아니다: OpenAI Jalapeño가 낸 첫 숫자 OpenAI는 8월 25일 자체 커스텀 추론 칩 Jalapeño의 첫 측정치를 공개했다. InferenceX에서 피크 처리량/킬로와트가 더 높고 토큰 지연시간이 더 낮았다는 숫자이지, 파트너 GPU를 버리겠다는 발표가 아니다.
AI 뉴스 프롬프트는 안 준다: Mythos 5가 스캔만 하는 이유 Anthropic은 8월 21일, Claude Enterprise의 Claude Security 스캔을 Claude Mythos 5로 돌린다고 밝혔다. 고객이 받는 것은 CWE·신뢰도·심각도와 패치 초안이지, 모델에 붙는 프롬프트 창이 아니다.
producthunt 2026-08-24: Product Hunt 지난주 톱10 지난주(8월 17–23일) Product Hunt 주간 1–10위는 로컬 영상·회의 기록부터 B2B 크리에이터·웹 방문자 영업, 에이전트 배포와 사용자 맞춤 기능까지 ‘실제 현장으로 나가는 AI’가 모였다. 커뮤니티가 고른 것은 모델 이름보다, 일을 맡기고 결과를 남기는 제품이다.
AI 뉴스 토큰보다 하네스가 싸다: GPT-5.6이 Kiro에 앉은 이유 OpenAI는 8월 24일 GPT-5.6 패밀리(Sol·Terra·Luna)를 AWS의 코딩 에이전트 Kiro에 앉혔다고 적었다. 공동 테스트가 말하는 약 82%는 정답률이 아니라, 성공한 Terminal-Bench 과제 비용이 스펙 주도 하네스 안에서 줄었다는 주장이다.
AI 뉴스 기본값이 바뀌었다: Hugging Face가 센 올해 오픈 모델 Hugging Face는 8월 14일 허브(1~7월) 센서스를 올렸다. 공개 모델은 243만에서 296만으로 늘었지만, 파생의 기본 베이스는 Qwen으로 옮겨 앉았다. 좋아요는 흥분을, 다운로드는 파이프라인을 센다.
AI 뉴스 답을 주지 않는다: ChatGPT가 13–17세를 따로 뺀 이유 OpenAI는 2026년 8월 18일 ChatGPT for Teens를 공개했다. 시스템이 18세 미만으로 추정하거나 본인이 13–17세를 밝히면 자동으로 들어가고, 숙제 지름길을 스터디 모드로 돌리는 게 기본값이다. 교실 밖 학습용이고, 교실은 ChatGPT for Teachers가 기관이 관리한다.
AI 뉴스 봉쇄안이 비어 있다: Guidelight가 프론티어 5사에 준 성적 Guidelight AI Standards는 2026년 8월 18일 기준 공개 자료만으로 Anthropic·OpenAI·Google·xAI·Meta를 통제 표준 여섯 항목에서 채점했고, 전체는 C+(2.50)·C+(2.50)·D+(1.50)·D−(0.83)·F(0.67)다. 어느 회사도 한 항목에서 3을 넘지 못했고, TechCrunch가 22일 전한 ‘OpenAI 1위, Anthropic·Meta 최하위’는 봉쇄안 칸이지 전체 성적이 아니다.
AI 뉴스 타입은 그대로다: TypeScript 7이 Go로 이식된 이유 Microsoft는 2026년 7월 8일 TypeScript 7.0을 Go 네이티브 포트로 올렸고, 공식 표는 전체 빌드가 보통 8–12배 빨라진다고 했다. 타입과 구조는 그대로 두고 속도를 바꿨지만 프로그램 API는 7.1까지 없으며, 8월 22일 GitHub Daily에서 microsoft/TypeScript가 6위에 다시 앉았다.
AI 뉴스 반값은 올해뿐이다: Gemini 3.7 Flash가 일하는 가격 Google은 8월 13일 Gemini 3.7 Flash를 올렸고, 올해 말까지 입력 100만 토큰 $0.75·출력 $3.75로 3.6 Flash 원래 값의 반값이라고 했다. 1월 1일부터는 $1.50/$7.50로 돌아가며, FrontierCode 43.6%와 DeepSWE 65.3%는 Google이 보고한 점수다.
AI 뉴스 실험대를 돌린다: Claude가 오픈소스 단백질 스택을 맡은 이유 Anthropic은 8월 18일, Claude가 단백질 모델을 발명하지 않고 오픈소스 스택을 돌려 15개 표적 중 14개에서 바인더를 냈다고 밝혔다. 히트율 22–35%는 업계 전형 10–15%를 웃돌지만, 숫자는 회사 보고서이고 독립 심사는 아직 없다.
AI 뉴스 채팅창을 건너뛴다: OpenAI가 Codex 하네스를 연 이유 OpenAI는 8월 21일 개발자 블로그에서, App·CLI·IDE Extension을 돌리는 같은 오픈소스 Codex 하네스를 제품 안으로 가져오라고 했다. 범용 채팅 창으로 일을 옮기지 말고, 대시보드와 승인 흐름이 이미 있는 자리에 에이전트 루프를 붙이라는 문장이다.
AI 뉴스 숙제를 스스로 낸다: Ornith-1.5가 연 자기개선 루프 Ornith AI가 2026년 8월, 스스로 과제를 내고 푸는 Ornith-1.5 오픈 웨이트 패밀리를 397B·35B·9B로 공개했다. 벤치 점수는 전부 벤더 자체 평가이고, 독립 트래커는 아직 순위를 매기지 않는다.
AI 뉴스 테스트만 초록이다: CopilotKit OpenBot이 판 감사 로그 CopilotKit가 공개한 OpenBot은 자체 인프라에서 동작마다 결정을 내리고 감사 로그를 남기는 오픈소스 엔터프라이즈 에이전트라고 한다. 리뷰어들이 연 이슈의 공통점은, 그 결정 함수가 테스트에는 있고 실행 게이트에는 없다는 것이다.
OpenAI 프론티어를 주차하다: OpenAI가 Astra를 사이버 Critical로 본 이유 OpenAI는 8월 18일, Hugging Face 사고와 차기 모델 Astra의 사이버 Critical 가능성 때문에 배포용 최신 모델의 강화 학습을 2주 멈추고 가장 큰 프론티어 RL 런을 홀드했다고 밝혔다. 안전장치가 스케일을 따라가지 못하면, 학습 속도 자체가 제품 일정이 되는 국면이다.
오픈소스 칩을 갈아끼울 언어: Qualcomm이 Mojo 컴파일러를 연 이유 Modular은 8월 18일 ModCon에서 Mojo 컴파일러와 툴체인을 Apache 2.0(LLVM 예외)으로 공개했다. Qualcomm이 7월 말 인수를 마친 지 세 주, 1.0 소스 안정성 발표 일주일 만의 개방이며 컴파일러 외부 PR은 올해 말까지 닫혀 있다.
Claude 대시보드를 건너뛴다: ElevenLabs 에이전트가 Claude 대화로 들어왔다 ElevenLabs는 8월 17일 호스티드 MCP를 Claude 커넥터 디렉터리에 올렸다. OAuth로 한 번 로그인하면 에이전트를 만들고 고치고 복제하고 지울 수 있으며, 반영 전에 LLM 사용량과 비용을 추정할 수 있다.
Claude 고치는 시간이 더 길다: 의회 법안을 잠식하는 AI 초안 Politico는 하원 입법고문실이 Claude와 ChatGPT로 쓰인 법안 초안을 고치는 데, 처음부터 쓰는 것보다 더 많은 시간을 쓴다고 전했다. 입법의 품질 관리 계층은 상용 AI를 쓰지 못하도록 막혀 있어, 의원실과 외부 단체가 쏟아내는 생성 텍스트를 혼자 떠안는 구조다.
오픈소스 하네스는 이미 있다: Block이 Berd로 연 에이전트 작업면 Block은 8월 18일 내부용 데스크톱 앱 Berd를 Apache 2.0으로 공개했다. 대화는 기기에 남고 Goose·Claude Code·Codex를 한 작업면에서 다루며, 코드는 열리되 외부 PR은 자동으로 닫힌다.