MAIN NEWS 1
Anthropic claims its new Claude Opus 5 delivers near-Fable 5 performa...
무슨 일이 있었나
Anthropic이 새 모델 Claude Opus 5를 발표하고, Fable 5와 비슷한 성능을 토큰 가격의 절반에 제공한다는 주장을 했다. ARC-AGI-3에서 30.2%를 기록해 GPT-5.6 Sol보다 거의 4배 높은 성능을 보였다.
왜 중요한가
Opus 5는 토큰 비용을 절반으로 낮추면서도 Fable 5와 비슷한 성능을 제공해 기업이 비용 효율적으로 AI를 활용할 수 있게 한다. 또한 ARC-AGI-3에서 GPT-5.6 Sol보다 4배 높은 성능을 보이며, 코드 작성·지식 작업에서 우수한 점수를 기록해 AI 개발·운영 비용 절감과 생산성 향상에 기여할 전망이다.
앞으로 볼 점
관련 기관과 기업의 후속 발표, 독립적인 검증 자료가 추가로 공개되는지 확인해야 한다.
원문 확인 ↗
MAIN NEWS 2
Classifiers: Track What Your Agents Do and What It Costs
무슨 일이 있었나
OpenRouter가 베타 기능인 Classifiers를 공개해, 생성된 텍스트에 부서·작업 유형·복잡도 등 메타데이터를 자동으로 태깅할 수 있게 했다. 사용자는 taxonomy를 정의하고, 선택한 모델(Gemini 3.5 Flash Lite 등)을 적용해 로그에 저장하며, 샘플링률로 비용을 조절할 수 있다.
왜 중요한가
이 기능은 AI 사용 보고와 비용 할당, 규정 준수를 한눈에 파악하도록 돕는다. 로그에 태그가 붙은 요청을 필터링·집계하면 부서별·작업별 모델 활용과 지출을 시각화할 수 있어, 조직의 AI 거버넌스와 효율성을 높일 수 있다.
앞으로 볼 점
공식 출시 일정과 공개 벤치마크, 실제 사용자 환경에서의 성능 검증이 이어지는지 확인해야 한다.
원문 확인 ↗
MAIN NEWS 3
Show HN: Drive your real logged-in Chrome from Claude Code and Codex...
무슨 일이 있었나
Browser Bridge라는 로컬 MCP 서버와 Chrome 확장 프로그램이 공개되어, Claude Code와 OpenAI Codex 같은 AI 에이전트가 실시간 로그인된 크롬 세션을 제어할 수 있게 되었습니다.
왜 중요한가
이 도구는 헤드리스 브라우저가 필요 없고 기존 로그인 세션을 그대로 이용해 API 트래픽 캡처, 보안 테스트, 그리고 자체 회복형 playbook 작성 및 세션 재생을 지원함으로써 AI 기반 자동화와 테스트를 보다 현실적이고 안전하게 수행할 수 있도록 합니다.
앞으로 볼 점
원문 근거와 후속 토론, 재현 가능한 검증 또는 공식 발표가 이어지는지 확인해야 한다.
원문 확인 ↗