- LiteLLM v1.96.0 업데이트 및 Docker 이미지 서명 확인 방법
- Claude Code v2.1.227 업데이트 내용
- Meta에서 새로운 멀티모달 모델 Muse Glimmer 출시
- vLLM v0.27.0 버전 출시 개요
- AI 에이전트의 워크로드를 모델 간에 분산하는 방법
- 토스 QA 플랫폼 ‘토션’ 소개
- NVIDIA, 새로운 AI 모델 Nemotron 3.5 Lightning 출시
- 마크 저커버그, AI 분배와 발전을 위한 새로운 비전 제시
- Claude AI의 수학 문제 도전과 해킹 사건
- MiniMax-H3의 macOS 네이티브 실행 엔진 개발
- 앤트로픽, 클로드 모델에 보이지 않는 워터마크 도입
- 마이크로소프트, 차세대 AI 가속기 ‘마이아 300’ 생산 계획 발표
- 사전 동의 없는 텔레마케팅 전면 금지 발표
- AI 모델 비용, 최저 수준으로 하락
- GitHub Actions, OIDC 토큰의 취약성 문제 발생
- Anthropic, 91억 달러 데이터 센터 계약 체결
- 기업 시스템 보안 위협, 개인정보 유출 가능성
- 실시간 입 모양 동기화를 통한 생성형 영상 기술
- AI 에이전트와 판매 전략의 간극
- AI 시대, 과학의 종말은 오지 않았다
LiteLLM v1.96.0 업데이트 및 Docker 이미지 서명 확인 방법
LiteLLM v1.96.0 버전에서는 모든 Docker 이미지가 cosign으로 서명되며, 릴리스는 특정 커밋 해시를 통해 확인할 수 있다. 주요 변경사항으로는 Prometheus의 서비스 티어 레이블 추가, aiohttp의 세션 재구축 시 keep-alive 커넥터 설정 유지, Helm 차트에서 PostgreSQL과 Redis의 특정 이미지 고정 등이 포함된다. 또한, 여러 버그 수정이 이루어져 JWT 팀에 대한 기본 메시지 허용, 삭제된 배포를 가리키는 모델 별칭 무시, 비호환 모델 쓰기 거부 등의 내용이 포함된다. 이번 업데이트는 성능 개선을 위한 다양한 조치를 포함하고 있다. 한국 개발자는 이 업데이트를 통해 LiteLLM를 안전하게 구현하고 성능 개선을 활용할 수 있다.
원문에서 자세히 보기: LiteLLM Releases
Claude Code v2.1.227 업데이트 내용
이번 업데이트에서는 사용자의 구독 계층과 관계없이 기능 플래그가 평가되는 문제를 수정하여 Max 요금제 사용자의 잘못된 요청을 방지했습니다. 또한, GitHub 호스팅 러너에서 claude-code-action을 사용할 때 모든 Bash 명령이 실패하는 문제를 해결했습니다. ‘/tui’ 명령어가 첫 메시지 이전의 대화를 불러오는 오류도 수정되었습니다. 슬래시 명령어 메뉴가 개선되어 선택된 행은 파란색으로 표시되고, 일치하는 문자가 굵게 표시됩니다. 더욱이 파일 미발견 제안 및 멘션 크기 체크에서 이벤트 루프 지연이 줄어들어 성능이 향상되었습니다. 한국 개발자는 이번 버전의 개선사항을 적용하여 더 나은 사용자 경험을 제공할 수 있습니다.
원문에서 자세히 보기: Claude Code Releases
Meta에서 새로운 멀티모달 모델 Muse Glimmer 출시
Meta는 30B 매개변수로 구성된 새로운 멀티모달 모델인 Muse Glimmer를 출시하였으며, 이는 Apache 2.0 라이선스 하에 배포된다. 이 모델은 비전 인코더와 텍스트 디코더로 구성되어 있으며, 개인 비서, 문서 분석, 코딩 등의 에이전트 기반 용도에 적합하다. Muse Glimmer는 로컬 환경에서 개인 정보 보호를 중시하는 애플리케이션에 배포할 수 있다. 추가적으로 GraniteMoeSWA 및 GraniteSWA 모델에 대한 지원이 추가되었다. 새로운 모델들의 사용과 관련된 문서도 함께 제공된다. 한국 개발자는 Muse Glimmer를 활용하여 다양한 개인 맞춤형 AI 솔루션을 개발할 수 있다.
원문에서 자세히 보기: Transformers Releases
vLLM v0.27.0 버전 출시 개요
vLLM v0.27.0 버전은 242명의 기여자와 561개의 커밋으로 구성되어 있으며, Kimi K3를 포함한 여러 새로운 모델 지원이 추가됐다. 주요 기능으로는 PyTorch 2.13.0 업그레이드, FlashAttention 4 통합, DeepSeek-V4 성능 개선 등이 있다. 또한, 비-generative 작업을 지원하는 Model Runner V2의 기능 확장과 대규모 서비스 안정성을 제공하는 결함 허용 프레임워크가 포함됐다. 고급 하드웨어 지원을 위한 조기 개발도 이루어져 있다. 이러한 변경사항으로 인해 한국 개발자들은 새로운 모델을 활용하거나 플랫폼의 성능을 최적화할 수 있는 기회를 가질 수 있다.
원문에서 자세히 보기: vLLM Releases
AI 에이전트의 워크로드를 모델 간에 분산하는 방법
AI 에이전트를 구축하기 위해서는 단일 모델 선택에 그치지 않으며, 각 모델은 특정 강점과 약점, 비용 프로필을 가지고 있어 상황에 따라 적합성이 달라질 수 있다. NVIDIA NeMo Switchyard는 여러 모델에서 AI 에이전트의 워크로드를 효과적으로 관리하고 최적화할 수 있는 프레임워크를 제공한다. 이 도구는 협업 다중 모델 아키텍처를 지원하며, 사용자가 모델을 조정하고 워크로드를 전환하는데 필요한 기능을 포함하고 있다. 또한, 실시간 성능을 타겟으로 하여 다양한 작업을 수행할 수 있는 기반을 마련한다. 개발자들은 이 기술을 활용하여 자신만의 AI 에이전트를 구축하는 데 집중할 수 있다.
원문에서 자세히 보기: NVIDIA Technical Blog
토스 QA 플랫폼 ‘토션’ 소개
토스 QA 플랫폼 팀이 개발한 ‘토션’(Tossion)은 최근 QA 프로세스를 개선하기 위해 설계된 새로운 테스트 관리 시스템이다. 이 시스템은 자동화 테스트 결과, 매뉴얼 테스트 결과, 테스트 케이스를 하나의 플랫폼에 통합하여 직관적인 인터페이스를 제공한다. 각 테스트 런은 과거의 데이터와 함께 저장되어, 어떤 변경사항에도 쉽게 접근 가능하다. 사용자의 요청에 대한 반영 속도가 빨라 기능 개선이 즉각적으로 이루어질 수 있도록 설계되었다. 또한, AI를 통해 QA 과정의 효율성을 높일 계획도 세우고 있다. 한국 개발자는 이 시스템을 활용하여 테스트 관리 프로세스를 최적화할 수 있다.
원문에서 자세히 보기: 토스 기술 블로그
NVIDIA, 새로운 AI 모델 Nemotron 3.5 Lightning 출시
NVIDIA가 30B 혼합 전문가(mixture-of-experts) 아키텍처로 구성된 Nemotron 3.5 Lightning 모델을 출시했다. 이 모델은 항상 활성화된 AI 에이전트를 위해 최적화된 형태로, OpenClaw 및 Hermes Agent와 같은 플랫폼에서 활용될 예정이다. 또한, 기본 변경사항으로는 Nemotron 3 아키텍처의 추가와 Muse Glimmer 함수 호출 파서의 경계 조건 처리 업데이트가 포함된다. 한편, 구글은 차세대 경량 AI 모델인 제미나이 3.7 플래시의 출시를 준비하는 것으로 보이며, 내부 SDK에 관련 코드가 포함된 것으로 확인됐다.
참고 출처 (3개 매체 종합)
마크 저커버그, AI 분배와 발전을 위한 새로운 비전 제시
마크 저커버그는 최근 에세이를 통해 AI의 발전과 기회를 전 세계 사용자와 데이터 센터가 위치한 지역 사회에 나누는 새로운 전략을 발표했다. 그는 오픈 웨이트 모델을 더 많이 공개하고, 메타가 데이터 센터를 운영하는 지역 사회에 투자하기 위해 10억 달러 기금을 조성할 계획이다. 또한, 저커버그는 메타의 접근 방식이 인류에 재앙적 결과를 초래할 가능성이 가장 낮다는 믿음을 표현했다. 이러한 발언은 고급 AI 개발에 대한 논쟁에 중요한 변화를 가져올 수 있다.
참고 출처 (2개 매체 종합)
Claude AI의 수학 문제 도전과 해킹 사건
Claude는 최근 수학의 가장 유명한 미해결 문제 중 하나인 리만 가설에 도전했다. 비록 성공하지는 못했지만, 이와 관련된 문제에서 기존의 리만 제타 함수의 영점을 만족하는 하한을 개선하는 성과를 거두었다. 이는 Claude와 같은 AI 모델이 수학자들의 아이디어를 새로운 방식으로 확장할 수 있음을 보여준다. 한편 Claude는 헬스장 웹사이트 해킹 사건에서도 주목받고 있으며, 이 과정에서 발생한 기술적 영향을 분석하는 내용을 담은 에피소드도 공개되었다.
참고 출처 (3개 매체 종합)
MiniMax-H3의 macOS 네이티브 실행 엔진 개발
antirez가 개발한 h3.c는 애플 실리콘 Mac에서 MiniMax-H3를 C/Objective-C/Metal 기반으로 네이티브 실행할 수 있는 추론 엔진이다. 이 엔진은 텍스트와 함께 영상 및 오디오를 생성하는 기능을 제공하며, M3 Max와 M5 Max에 최적화된 Metal 및 TensorOps를 통해 성능을 극대화하고 있다. 이러한 기술적 발전은 특히 콘텐츠 생성 분야에서 새로운 가능성을 열 수 있는 중요한 진전을 나타낸다.
참고 출처 (2개 매체 종합)
앤트로픽, 클로드 모델에 보이지 않는 워터마크 도입
앤트로픽은 유럽연합의 AI 법 규제 준수를 위해 클로드 모델의 모든 출력에 보이지 않는 워터마크를 포함시키겠다고 밝혔다. 이 시스템은 2026년 8월 2일 이후 출시되는 신규 모델부터 적용되며, 텍스트의 출처를 추적하고 콘텐츠의 신뢰성을 높이는 데 기여할 것으로 예상된다. 워터마크는 텍스트와 파일에 직접 내장되어 복사 및 붙여넣기에도 적용되며, 편집 후에도 일부 유지될 수 있다. 이 조치는 전 세계적으로 시행될 계획이다.
참고 출처 (5개 매체 종합)
마이크로소프트, 차세대 AI 가속기 ‘마이아 300’ 생산 계획 발표
마이크로소프트는 자사의 새로운 AI 가속기 ‘마이아 300’을 오는 가을 공개하며, 내년부터 생산량을 크게 확대할 계획이다. 이 모델은 대만 TSMC와 협력하여 2027년까지 30만 개 이상의 칩 생산 능력을 확보할 예정이다. 이는 이전 모델인 ‘마이아 200’의 생산량이 수만 개에 불과했던 것과 대조적이며, 장기적으로는 생산 능력을 100만 개 이상으로 늘릴 계획이다.
참고 출처 (3개 매체 종합)
사전 동의 없는 텔레마케팅 전면 금지 발표
정부는 소비자를 보호하기 위해 2026년 8월 11일부터 사전 동의 없는 텔레마케팅 전화를 전면 금지한다고 발표했다. 이제 기업들은 먼저 소비자의 동의를 얻어야 하며, 소비자는 언제든지 동의를 철회할 수 있는 권리가 있다. 그러나 기존 계약 관계에 따른 신규 상업 제안은 예외로 허용된다. 이 조치는 소비자에게 더 나은 보호 장치를 제공하기 위한 노력으로 보인다.
참고 출처 (2개 매체 종합)
AI 모델 비용, 최저 수준으로 하락
AI 모델의 평균 추론 비용이 100만 토큰당 1.16~1.18달러로 떨어지며 올해 최저 수준에 이르렀습니다.
원문에서 자세히 보기: AI Times
GitHub Actions, OIDC 토큰의 취약성 문제 발생
GitHub Actions의 OIDC 토큰 취약성으로 서드파티 코드가 권한을 확장할 수 있다.
원문에서 자세히 보기: GeekNews (전체)
Anthropic, 91억 달러 데이터 센터 계약 체결
Anthropic은 Riot Platforms와 91억 달러의 데이터 센터 계약을 체결했다.
원문에서 자세히 보기: THE DECODER
기업 시스템 보안 위협, 개인정보 유출 가능성
기업 시스템이 noreply.net으로 고객 정보를 자동 전송해 보안 문제가 발생했다.
원문에서 자세히 보기: GeekNews (전체)
실시간 입 모양 동기화를 통한 생성형 영상 기술
입 모양과 오디오 동기화로 200 FPS의 실시간 말하는 영상 생성 기술이 발표됐다.
원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)
AI 에이전트와 판매 전략의 간극
AI 에이전트를 준비했지만, 판매 전략은 여전히 부족한 상황이다.
원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)
AI 시대, 과학의 종말은 오지 않았다
AI 시대에 과학의 종말 주장은 패러다임의 전환을 의미한다.
원문에서 자세히 보기: MIT Technology Review