- vLLM v0.25.0 버전 발표
- Vercel AI SDK 3.0.51 업데이트 사항
- LiteLLM v1.92.0 업데이트 및 Docker 이미지 서명 확인
- CUDA 메모리 없음 문제 해결 업데이트
- 로봇 정책 평가 방법 소개
- 오픈AI의 GPT-5.6, 50년 수학 문제 해결 보고
- AI 에이전트, 메모리 구조 개선으로 게임 성과 향상
- 분산 GPU 리소스를 통합하여 AI 모델 실행 최적화
- 테러리스트 그룹의 AI 챗봇 악용 사례
- Skillscript: 로컬 에이전트를 위한 간결한 프로그래밍 언어
- Microsoft와 Meta, 최대 1,222억 달러 규모의 네오클라우드 계약
- Claude Cowork, 비즈니스 프로세스에 최적화된 AI 도구
- GitHub Insights 데이터 영구 보존을 위한 오픈소스 앱 개발
- 트럼프 행정부, 중국 오픈소스 AI 모델 규제 논의 착수
- sqlite-utils 4.1 출시, 새로운 기능 추가
- 영국 연구진, 해양 달팽이 이빨의 강도 발견
- KAIST, AI 기반 뇌혈관질환 진단 프레임워크 개발
vLLM v0.25.0 버전 발표
vLLM v0.25.0 버전은 232명의 기여자로부터 558개의 커밋이 포함되었으며, 모델 러너 V2가 모든 밀집 모델의 기본으로 설정되었습니다. 새로운 기능으로는 EVS 지원, 실시간 임베딩, Mamba 하이브리드 모델을 위한 프리픽스 캐싱 등이 있으며, PagedAttention은 삭제되었습니다. Transformers 모델링 백엔드는 vLLM의 기본 속도로 개선되었고, 다양한 모델이 추가되었습니다. 새로운 스트리밍 파서 엔진도 도입되어 여러 가지 형식의 파싱과 추론을 지원합니다. 이와 같은 업그레이드는 GLM-5 시리즈와 MiniMax-M3와 같은 여러 새로운 모델과 함께 적용되었습니다. 한국 개발자는 이러한 모델의 새로운 기능 사용 및 최적화를 통해 다양한 AI 응용 프로그램을 개발할 수 있다.
원문에서 자세히 보기: vLLM Releases
Vercel AI SDK 3.0.51 업데이트 사항
Vercel AI SDK 3.0.51에서는 Groq 프로바이더의 프롬프트 캐시 읽기를 수정했습니다. convertGroqUsage에서 prompt_tokens_details.cached_tokens를 읽지 않아 캐시 히트가 cacheRead: undefined로 보고되었고, 모든 프롬프트가 캐시 없음으로 집계되는 문제가 있었습니다. 이제 Groq의 암묵적인 프롬프트 캐싱이 usage.cachedInputTokens로 나타나며, 이는 cacheRead에 매핑되어 noCache에서 차감됩니다. Groq는 캐시 생성 요금이 없으므로 cacheWrite는 여전히 정의되지 않습니다. 한국 개발자는 이 변경점을 활용하여 캐시 효과를 보다 명확히 분석할 수 있습니다.
원문에서 자세히 보기: Vercel AI SDK Releases
LiteLLM v1.92.0 업데이트 및 Docker 이미지 서명 확인
LiteLLM의 모든 Docker 이미지는 cosign으로 서명되며, v1.92.0 버전은 커밋 0112e53에서 소개된 동일한 키로 서명되었습니다. 이미지를 검증하는 방법으로는 커밋 해시를 사용하는 것이 추천되며, 태그를 이용한 검증도 가능합니다. 이번 릴리스에서는 프록시 및 캐싱 관련 버그 수정과 함께 새로운 기능인 유저 예산 메트릭에 user_email 및 user_alias를 추가했습니다. 또한 Gemini 3.5 Flash 및 Gemini 관리 에이전트에 대한 지원도 포함되어 있습니다. 추가적으로 테스트 안정화 및 UI 리팩토링 작업이 이루어졌습니다. 한국 개발자는 LiteLLM의 Docker 이미지를 신뢰할 수 있게 검증하여 안정적인 배포를 할 수 있습니다.
원문에서 자세히 보기: LiteLLM Releases
CUDA 메모리 없음 문제 해결 업데이트
새로운 업데이트는 CUDA 장치에서 사용 가능한 메모리가 없거나 제한적일 때 cudaMemGetInfo() 호출로 인한 치명적인 충돌을 방지합니다. 이전에는 메모리 쿼리 시 메모리 부족 오류로 인해 프로그램이 중단될 수 있었으나, 이제는 비치명적인 오류로 수정되어 장치에 총 및 자유 메모리를 0으로 할당합니다. 이러한 변경으로 인해 피팅 알고리즘이 해당 장치에서 레이어를 배치하는 것을 시도하지 않게 됩니다. 업데이트는 다양한 플랫폼에서 제공되며, 특히 macOS, Linux, Windows, Android 및 openEuler를 지원합니다. 한국 개발자는 이 업데이트를 활용해 메모리 문제로 인한 충돌 없이 CUDA 기반 애플리케이션을 안정적으로 운영할 수 있습니다.
원문에서 자세히 보기: llama.cpp Releases
로봇 정책 평가 방법 소개
로봇 기초 모델이 눈에 띄는 발전을 이루었다. 현재의 시스템들은 자연어 지침에 따라 품목을 선택, 배치, 정렬 및 조작할 수 있는 능력을 갖추고 있다. 이 블로그 글에서는 실제 세계에서 정책을 평가하기 위한 방법론을 논의하며, 로봇의 다양한 작업 수행 능력과 그 평가 기준을 설정하는 과정을 상세히 설명한다. 오늘날 로봇 정책의 평가에는 일반적인 시나리오를 기반으로 한 다양한 메트릭을 활용할 수 있으며, 이를 통해 로봇의 성능을 객관적으로 측정하고 개선할 수 있다. 한국 개발자는 이러한 방법론을 통해 자국의 로봇 시스템을 실제 환경에 맞게 최적화할 수 있다.
원문에서 자세히 보기: NVIDIA Technical Blog
오픈AI의 GPT-5.6, 50년 수학 문제 해결 보고
오픈AI가 새로운 모델 GPT-5.6을 발표하며 이 모델이 Microsoft 365 코파일럿에서 권장 모델로 채택됐다고 밝혔다. 한편, GPT-5.6 Sol Ultra는 50년 동안 풀리지 않았던 ‘사이클 이중 덮개 추측’을 1시간 만에 해결해 주목받고 있다. 이를 위해 64개의 서브 에이전트가 병렬로 작업했으며, 수학자들은 이 결과가 놀랍게도 기본적이라고 평가했지만, 이전 연구에 대한 인용이 부족하다는 점을 비판하고 있다. 이러한 발전은 AI가 기존 지식을 단순히 재조합하는지, 아니면 새로운 것을 창조하는지를 다시금 생각하게 만든다.
참고 출처 (2개 매체 종합)
AI 에이전트, 메모리 구조 개선으로 게임 성과 향상
AI 에이전트의 메모리 구조를 혁신한 연구 결과가 카드 게임 ‘Slay the Spire 2’에서 성공적인 성과를 보여 주목받고 있다. 기존의 대화 로그를 대체하는 다층 메모리 구조를 도입하여 토큰 수를 대폭 줄였고, 이로 인해 AI 에이전트는 10번의 게임 중 6번을 승리했다. 이는 대화 로그가 증가함에 따라 메모리가 비대해지는 문제를 해결한 사례로, AI 기술의 발전에 중요한 이정표로 평가된다. 여러 출처에서 이 연구에 대한 긍정적인 반응이 이어지고 있으며, AI와 메모리 아키텍처의 관계에 대한 논의가 활발히 진행되고 있다.
참고 출처 (3개 매체 종합)
분산 GPU 리소스를 통합하여 AI 모델 실행 최적화
여러 머신에 분산된 GPU와 메모리를 통합하여, 효율적으로 컴퓨팅 자원을 활용할 수 있는 기술이 개발되었다. 이 시스템은 로컬 실행, 피어 간 전달, 그리고 분할 실행을 지원하며, OpenAI 호환 API를 통해 접근할 수 있다. 요청 처리 과정에서는 로컬 GPU나 특정 모델을 로드한 피어가 활용되며, 큰 모델은 여러 노드에서 단계적으로 실행된다. 이러한 기술은 AI 모델의 실행 효율성을 크게 향상시킬 것으로 기대된다.
참고 출처 (2개 매체 종합)
테러리스트 그룹의 AI 챗봇 악용 사례
케임브리지 연구에서 보코 하람과 ISIS가 ChatGPT, Claude, Gemini와 같은 AI 챗봇을 사용하여 공격 계획과 무기 개발에 활용하고 있다는 사실이 밝혀졌다. 특히 ISIS 요원들은 2023년부터 안전 필터를 우회하는 방법을 교육하고 있으며, 이러한 필터가 악용을 막는 데 실패하고 있는 것으로 나타났다. 이러한 추세는 AI 제공업체의 자발적 규제가 충분하지 않음을 시사한다.
참고 출처 (2개 매체 종합)
Skillscript: 로컬 에이전트를 위한 간결한 프로그래밍 언어
Skillscript는 로컬 AI 에이전트의 효율적 작동을 위한 경량 프로그래밍 언어입니다.
원문에서 자세히 보기: Hacker News Frontpage
Microsoft와 Meta, 최대 1,222억 달러 규모의 네오클라우드 계약
Microsoft와 Meta의 네오클라우드 계약 규모가 최대 1,222억 달러에 이른다.
원문에서 자세히 보기: GeekNews (전체)
Claude Cowork, 비즈니스 프로세스에 최적화된 AI 도구
Claude Cowork의 주요 사용처는 비즈니스 프로세스 및 문서 생성으로 나타났다.
원문에서 자세히 보기: THE DECODER
GitHub Insights 데이터 영구 보존을 위한 오픈소스 앱 개발
GitHub Insights 데이터를 영구 보존할 수 있는 오픈소스 앱이 개발되었다.
원문에서 자세히 보기: GeekNews (전체)
트럼프 행정부, 중국 오픈소스 AI 모델 규제 논의 착수
트럼프 행정부가 중국산 오픈소스 AI 모델의 정부 사용 제한 방안을 논의하고 있다.
원문에서 자세히 보기: AI Times
sqlite-utils 4.1 출시, 새로운 기능 추가
sqlite-utils 4.1 버전이 출시되며 새로운 CLI 기능이 추가되었습니다.
원문에서 자세히 보기: Simon Willison
영국 연구진, 해양 달팽이 이빨의 강도 발견
영국 연구진이 해양 달팽이 이빨이 평균 5배 강하다는 사실을 발견했다.
원문에서 자세히 보기: GeekNews (전체)
KAIST, AI 기반 뇌혈관질환 진단 프레임워크 개발
KAIST 연구팀이 AI 기반 뇌혈관질환 진단 프레임워크를 개발했다.
원문에서 자세히 보기: AI Times