SOWN - Daily News

SomeWhere Olny We Know

Daily News #2026-09-12



  • Claude Code v2.1.268 업데이트 요약
  • 메탈 백엔드 퓨전 테이블 구조 재작업 및 최적화 개선
  • Biomolecular 구조 예측을 위한 BioNemo 추론 런타임 발표
  • Anthropic, Claude 악용 사례 보고서 발표
  • ChatGPT 금융 서비스 출시
  • OpenAI, Agents API 공개 베타 출시
  • OpenAI, 실시간 음성 AI 모델 GPT-Live-1 출시
  • North Small Translate, 25억 개 활성 파라미터로 언어 번역 분야 진출
  • SWE-2, FrontierCode의 성능 한계 극복
  • 미래 생명공학을 이끄는 35세 이하 혁신가들
  • Hemingway-bench의 EQ-Bench 성능
  • Meta Muse 앱, ‘공유 에이전트’ 기능 도입
  • OpenAI, 새로운 밀레니엄 문제를 해결했나?
  • OUI-1: 맞춤형 UI 요소 생성 모델
  • 첫 토큰 대기 시간, 하네스에 따라 12.2~225.7초까지 차이
  • 새로운 음악 모델 Yue23b 발표
  • AI 치료사의 문제점: 인간관계에 미치는 영향
  • Claude의 프로덕션 코드, 더 높은 기준이 필요하다
  • 미국 정치권, AI 위협 강력 규제 촉구
  • MS, 애저 데이터센터 용량 2032년까지 3배 확대 계획

Claude Code v2.1.268 업데이트 요약

버전 2.1.268에서 Claude 앱 게이트웨이에 새로운 설정 기능을 추가하여 관리된 환경에서 유료 사용 금액과 일치하도록 비용을 관리하게 되었다. 이제 비어있는 CIDR 허용 목록에 대한 스타트업 경고를 추가하였고, 자체 IPv4 블록에서 클로드 앱 게이트웨인에 로그인할 수 있는 관리 설정도 도입되었다. 세션 종료 시 관련 디렉토리 삭제를 위한 커맨드도 추가되었다. JSON 출력 형식 개선을 통해 인증 상태 확인과 플러그인 관리에 있어 사용자가 더 많은 정보를 얻을 수 있게 되었다. 여러 버그 수정 사항이 포함되어 있으며, 특히 CPU 사용량을 줄이고 다양한 경고 메시지를 해결하였다. 이 업데이트로 개선된 접근성 설정을 통해 기업 환경에서 보다 효율적인 관리가 가능해진다.

원문에서 자세히 보기: Claude Code Releases

메탈 백엔드 퓨전 테이블 구조 재작업 및 최적화 개선

메탈 백엔드를 위한 모든 퓨전 가능한 연산 패턴이 하나의 테이블에 정의되어 최적화 그래프와 연산 인코더에서 사용된다. 최적화 시에는 구조적 검사 모드가, 계산 시에는 전체 모드가 적용되며, 이를 통해 스네이크 활성화 함수의 재정렬을 방지한다. 또한, 퓨전 테이블 질의에서 상대적 인덱스 대신 절대 인덱스를 사용하여 퓨전 실패를 방지하고, 토큰 생성 성능이 5% 향상되었다. 새로운 GGML_METAL_FUSE_GDN_CACHE 키워드가 도입되어 Gated Delta Net과 KV 캐시 간의 패턴을 최적화하고, 새로운 테스트 케이스가 추가되었다. 기존의 메모리 범위 건너뛰기 기능은 더 이상 필요하지 않게 되었다. 이러한 기능 개선으로 메탈 환경에서의 계산 효율성이 강화되었다.

원문에서 자세히 보기: llama.cpp Releases

Biomolecular 구조 예측을 위한 BioNemo 추론 런타임 발표

NVIDIA는 BioNemo 추론 런타임을 통해 생체 분자 구조 예측을 프로테옴 규모로 효율적으로 수행할 수 있게 되었다. 이 런타임은 대규모 데이터 처리와 빠른 예측 유지에 중점을 두고 설계되었으며, GPU 가속을 활용하여 처리 성능을 향상시킨다. BioNemo는 쉽게 통합할 수 있는 API와 함께 제공되어 생물학적 데이터 분석에 직접 적용 가능하다. 사용자들은 이를 통해 대규모 단백질 구조 예측 작업을 효율적으로 수행할 수 있다. 뿐만 아니라, BioNemo는 다양한 생물학적 데이터 세트와 호환되어 연구의 범위를 넓힐 수 있다. 한국의 연구자들은 BioNemo를 활용하여 단백질 구조 연구를 가속화할 수 있는 기회를 가질 수 있다.

원문에서 자세히 보기: NVIDIA Technical Blog

Anthropic, Claude 악용 사례 보고서 발표

Anthropic은 최근 2025년 12월부터 2026년 8월까지의 기간 동안 Claude 모델을 악용한 여러 사건을 보고했다. 이 보고서에서는 위협 행위자들이 자율 카미카제 드론, 미사일 소프트웨어, 국가적 감시 시스템 구축에 Claude를 이용한 사례를 포함해 총 8개월 간의 악용 사례를 다룬다. 특히, 중국의 AI 연구소들이 Claude를 대량으로 사용하거나 훈련 데이터를 추출한 것으로 나타났으며, Qwen 팀만으로도 1억 5천만 회 이상의 요청이 있었다. 이러한 악용 사례는 회사의 이전 보고서 이후 진화한 모습으로, Claude Fable이나 Mythos 모델은 이와 관련되지 않았다고 확인됐다.

참고 출처 (3개 매체 종합)

ChatGPT 금융 서비스 출시

OpenAI는 재무 데이터를 기반으로 한 ChatGPT를 출시했다고 발표했다. 이 서비스는 GPT-6 Astra를 활용하여 연구, 모델링 및 클라이언트용 자료를 생성할 수 있다. 금융 기관 및 전문가들이 더욱 효율적으로 자료를 준비하고 분석을 수행할 수 있도록 설계되었다. 사용자는 기존의 재무 데이터를 통합하여 다양한 금융 분석 작업을 수행할 수 있다. 이 서비스는 금융 서비스 분야에서의 활용 가능성을 높이며, 기업들이 필요로 하는 정보의 질과 정확성을 개선하는 데 기여할 것으로 기대된다. 한국의 개발자는 이 기술을 통해 금융 분석 도구 개발에 활용할 수 있다.

원문에서 자세히 보기: OpenAI News

OpenAI, Agents API 공개 베타 출시

OpenAI가 Agents API를 공개 beta로 출시하며 개발자들에게 Codex와 ChatGPT의 기반 인프라를 제공하고 있다. 이 API는 개발자가 자율적으로 운영되는 클라우드 에이전트를 구축할 수 있도록 하며, 코드 실행 및 하위 에이전트에게 작업을 위임하는 기능을 포함하고 있다. 에이전트는 오랫동안 실행될 수 있는 구조를 가지고 있으며, 추가 요금은 토큰 사용량에 따라 부과된다. Cloudflare, Vercel, Oracle이 추가 샌드박스 환경을 제공하고 있다.

참고 출처 (2개 매체 종합)

OpenAI, 실시간 음성 AI 모델 GPT-Live-1 출시

OpenAI가 실시간으로 대화를 나누는 전이중 음성 AI 모델인 GPT-라이브-1(GPT-Live-1)을 API 형태로 출시했다. 이 모델은 사람과의 대화 중 상대방의 말을 듣고 즉각적으로 응답할 수 있는 기능을 제공하며, 이전 모델에 비해 상호작용 점수가 80.1%로 크게 향상되었다. 개발자들은 이 API를 통해 전화 상담이나 예약 서비스에 심리스한 음성 에이전트를 구축할 수 있게 되었다. GPT-Live-1의 사용 비용은 분당 $0.05로, 상대적으로 높은 편이다.

참고 출처 (3개 매체 종합)

North Small Translate, 25억 개 활성 파라미터로 언어 번역 분야 진출

North Small Translate 모델이 25억 개의 활성 파라미터로 50개 언어 번역을 지원한다.

원문에서 자세히 보기: TLDR AI

SWE-2, FrontierCode의 성능 한계 극복

SWE-2 모델이 FrontierCode에서 50.0%의 성능을 달성하며 64% 비용 절감에 성공했다.

원문에서 자세히 보기: TLDR AI

미래 생명공학을 이끄는 35세 이하 혁신가들

MIT의 ‘35 Innovators Under 35’ 리스트에 포함된 생명공학 혁신가들에 대한 소개.

원문에서 자세히 보기: MIT Technology Review

Hemingway-bench의 EQ-Bench 성능

Hemingway-bench는 EQ-Bench에서 높은 순위를 기록한 창의적 글쓰기 모델이다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

Meta Muse 앱, ‘공유 에이전트’ 기능 도입

Meta Muse 앱이 사용자들이 맞춤형 에이전트를 만들고 공유할 수 있는 기능을 추가한다.

원문에서 자세히 보기: TLDR AI

OpenAI, 새로운 밀레니엄 문제를 해결했나?

OpenAI가 새로운 밀레니엄 문제의 해결에 한 걸음 다가섰다는 소식이 전해졌습니다.

원문에서 자세히 보기: The Neuron

OUI-1: 맞춤형 UI 요소 생성 모델

OUI-1은 DiffusionGemma 기반의 맞춤형 UI 요소를 생성하는 모델이다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

첫 토큰 대기 시간, 하네스에 따라 12.2~225.7초까지 차이

하네스에 따라 LLM의 첫 토큰 대기 시간이 12.2~225.7초로 달라질 수 있다.

원문에서 자세히 보기: GeekNews (전체)

새로운 음악 모델 Yue23b 발표

새로운 음악 모델 Yue23b가 발표되어 창작자들에게 새로운 가능성을 제공한다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

AI 치료사의 문제점: 인간관계에 미치는 영향

AI 치료사가 인간관계에 부정적인 영향을 미칠 수 있다는 우려가 제기되고 있다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

Claude의 프로덕션 코드, 더 높은 기준이 필요하다

Claude가 생성하는 프로덕션 코드의 품질 기준을 강화할 필요가 제기됐다.

원문에서 자세히 보기: Simon Willison

미국 정치권, AI 위협 강력 규제 촉구

미국 정치권이 AI의 실존적 위협에 대해 강력한 규제를 촉구하고 있다.

원문에서 자세히 보기: AI Times

MS, 애저 데이터센터 용량 2032년까지 3배 확대 계획

MS가 애저 데이터센터 용량을 2032년까지 3배 확대할 계획이다.

원문에서 자세히 보기: AI Times