- 테라헤르츠 통신을 위한 측정 기반 다층 디지털 트윈 프레임워크
- Claude Code v2.1.259 업데이트 내용
- Llama.cpp의 새로운 메탈 sparse FA 기능 추가
- LangChain 1.4.0 릴리스 요약
- NVIDIA, 로컬 네트워크의 컴퓨팅 가능성 확장하는 가상 추론 라우터 발표
- vLLM v0.29.0rc2 릴리스 노트
- Claude Fable 5.1의 주요 특징과 성과
- Nvidia, Hugging Face 인수로 AI 모델 플랫폼 장악
- Ollama v0.33.3 버전 업데이트 내용
- 오픈AI, 차세대 AI 모델 ‘아스트라’ 발표
- 구글, Gemini 3.8 Flash 모델 출시
- 에이전틱 AI의 기업 배치 확대: 작동 안전성 확보의 도전
- 디퓨전과 AR 결합으로 3.85배 가속된 OCR 모델
- ChatGPT 페이지, 향상된 대화 기능과 Deep research 제공
- Polars 2.0rc1 – 성능 및 API 개선 중심의 첫 릴리스 후보
- 실시간 반응하는 인터랙티브 영상 생성 AI 개발
- 마인드로직, AI 온이음 사업 선정 및 교육 서비스 제공
- .name 3단계 도메인 폐지, ICANN 승인
- 인월드 AI, 감정 이해 가능한 차세대 음성 생성 모델 발표
- LLM의 지속학습 ‘팰컨’ 프레임워크로 업그레이드
테라헤르츠 통신을 위한 측정 기반 다층 디지털 트윈 프레임워크
AI 컴퓨팅의 급격한 성장은 유연하고 고용량의 데이터 센터 간 연결에 대한 수요를 증가시키고 있다. 테라헤르츠(THz) 통신은 초광대역 대역폭과 높은 공간 재사용 능력 덕분에 미래 무선 데이터 센터에 유망한 솔루션으로 부상하고 있으며, 디지털 트윈(DT)을 통해 효율적인 무선 계획과 실시간 최적화를 가능하게 한다. 본 연구에서는 THz 무선 데이터 센터를 위한 측정 기반의 다층 DT 프레임워크를 제안하며, 물리적, 채널, 평가, 조작 층이 하향식으로 점진적으로 구성된다. 140, 220, 300 GHz에서 실시된 광범위한 채널 측정을 통해 주파수 의존적인 전파 특성이 characterization되었고, 이 데이터를 기반으로 물리적 트윈이 최적화되었다. AI 채널 트윈은 지리적 위치에 따른 채널 통계 정보를 학습하여 실시간 수신 전력과 LoS 확률을 예측할 수 있다. 실험 결과 제안된 AI 트윈은 기존 신경망 기반과 비교하여 낮은 전력 재구성 오류를 보였으며, 10 dB 신호 대 간섭 더하기 잡음 비율(SINR) 기준에서 90% 이상의 커버리지를 달성하였다. 한국 개발자는 이러한 프레임워크를 활용하여 데이터 센터 커버리지와 성능을 향상시킬 수 있다.
원문에서 자세히 보기: arXiv cs.LG
Claude Code v2.1.259 업데이트 내용
이번 업데이트에서는 managedMcpServers 설정이 추가되어 조직이 HTTP/SSE MCP 서버를 모든 사용자에게 제공할 수 있게 되었다. 또한, 무인 헤드리스 호스트를 위한 --permission-prompts none 옵션이 추가되어 자동으로 모든 알림을 거부한다. GitLab 병합 요청 관련 기능이 강화되어, 요청이 요약 툴에 MR !N으로 표시된다. claude plugin validate 명령에 --json 옵션이 추가되어 머신 리더블한 검증 리포트를 생성할 수 있다. 여러 세션 간의 상호작용 문제 및 이전 버전에서 발생한 오류들이 수정되었고, GitHub 연결 체크가 각 실행마다 수행되지 않도록 개선되었다. 이를 통해 개발자는 새로운 설정과 수정 사항을 활용하여 보다 안정적으로 시스템을 운영할 수 있다.
원문에서 자세히 보기: Claude Code Releases
Llama.cpp의 새로운 메탈 sparse FA 기능 추가
이번 릴리스에서는 메탈 환경에서 sparse FA를 지원하는 기능이 추가되었다. 새로운 kernel_flash_attn_ext_vec_idx가 도입되어 행 별 인덱스 목록으로 유한 마스크 항목을 압축할 수 있으며, n_kv_max가 0보다 클 때와 마스크가 존재하는 경우에만 활성화된다. 또한, sparse path 관련 버그가 수정되었고, 이전의 이중 마스크 읽기가 단일 패스 처리로 최적화되었다. 테스트 케이스가 추가되어 성능 평가가 가능하며, 다양한 키-값 크기 및 배치 크기에 대해 성능 측정이 이루어질 수 있다. 이 릴리스는 macOS와 Linux에서 지원되며, Ubuntu의 여러 아키텍처에서 실행 가능하다. 한국 개발자들은 이 새로운 기능을 활용하여 메탈 환경에서의 sparse 주의 메커니즘을 구현할 수 있다.
원문에서 자세히 보기: llama.cpp Releases
LangChain 1.4.0 릴리스 요약
LangChain의 새 버전인 1.4.0에서는 여러 가지 주요 변경 사항이 포함됐다. 새로운 ‘langchain.mcp’ 네임스페이스와 ‘MCPAdapter’ 기능이 추가되었으며, ‘langchain.mcp’에 대한 실행 가능한 예제가 제공된다. 성능 개선으로는 Anthropic 및 LangChain에서 미들웨어 추적 입력을 생략하는 수정이 포함됐다. 또한, 에이전트 도구 라우팅에서 모델 목적지를 포함하도록 수정되었고, vcrpy 테스트 종속성의 최소 버전이 8.2.0으로 상향 조정됐다. 한국 개발자는 새로운 네임스페이스와 어댑터를 활용해 맞춤형 모델을 구축할 수 있다.
원문에서 자세히 보기: LangChain Releases
NVIDIA, 로컬 네트워크의 컴퓨팅 가능성 확장하는 가상 추론 라우터 발표
NVIDIA는 ‘가상 추론 라우터’ 기술을 통해 여러 AI 에이전트가 협력하여 복잡한 작업을 처리할 수 있도록 지원한다고 발표했다. 이 기술은 주 에이전트가 복잡한 과제를 더 작은 작업으로 나누고, 이를 전문화된 하위 에이전트에게 할당할 수 있는 구조를 제공한다. 또한, 이 시스템은 로컬 네트워크에서 실행 가능하며, 병렬 처리를 통해 효율성을 높일 수 있다. 이로 인해 기업은 AI 기술을 활용한 다양한 응용 프로그램의 성능을 개선할 수 있는 기회를 갖게 된다. 사용자는 이 기술을 통해 자신만의 AI 솔루션을 쉽게 구축할 수 있다.
원문에서 자세히 보기: NVIDIA Technical Blog
vLLM v0.29.0rc2 릴리스 노트
vLLM의 v0.29.0rc2 버전에서는 멀티모달 기능에 대한 버그 수정을 포함하여 SHM(worker cache)에서 접두사에 의해 가려진 항목을 처리하는 개선이 이루어졌다. 이 버전은 새로운 기능이나 주요 업데이트가 포함되어 있지 않으며, 오류 수정이 주된 내용이다. 사용자에게는 이 업데이트가 성능과 안정성 향상에 기여할 것으로 기대된다. 제품과 관련된 구체적인 라이선스 및 가격 정보는 제공되지 않았다. 한국 개발자는 이 버전으로 멀티모달 기능을 보다 안정적으로 활용할 수 있다.
원문에서 자세히 보기: vLLM Releases
Claude Fable 5.1의 주요 특징과 성과
Claude Fable 5.1은 에이전트 군집을 활용하여 실제 장소를 조사하고 이를 3D로 모델링한 후, 사용자가 브라우저에서 탐색할 수 있는 형태로 재구성하는 작업을 수행했다. 이 모델은 단순한 3D 장면 생성에 그치지 않고, 자료 조사와 Blender 자산 생성, Three.js 조립 등 광범위한 과정을 거쳐 전문가의 검수를 통과하였다. 또 이 모델은 1653년에 작성된 왕당파의 메시지를 해독하는 성과를 거둬, 수세기 동안 풀리지 않았던 문제에 대한 해결을 이끌어냈다.
참고 출처 (4개 매체 종합)
Nvidia, Hugging Face 인수로 AI 모델 플랫폼 장악
Nvidia가 Hugging Face를 약 129억 달러에 인수할 계획을 발표했다. 이 플랫폼은 1800만 명 이상의 개발자와 20만 개 이상의 기업이 사용하는 오픈 AI 모델의 중심 허브로 기능하고 있다. Nvidia의 CEO인 젠슨 황은 플랫폼이 계속해서 오픈되고 하드웨어 중립적인 상태를 유지할 것이라고 밝혔지만, 이번 인수로 강력한 컴퓨팅 배급 경로를 확보하게 된다. 이는 Nvidia의 AI 확장을 위한 전략적 요소로 주목받고 있다.
참고 출처 (2개 매체 종합)
Ollama v0.33.3 버전 업데이트 내용
Ollama의 최신 버전인 v0.33.3에서 gemma4는 MLX 엔진에서 이미지와 오디오를 지원하게 되었다. 또한, 캐시된 프롬프트 토큰을 보고하며, GGUF 모델이 정의한 기본 매개변수를 존중하도록 개선되었다. MLX, MLX-C 및 llama.cpp도 업데이트되었다. 이번 버전에서 새로운 기여자로 @marcelpetrick가 처음으로 기여하였다. 한국 개발자는 이 업데이트를 통해 MLX 엔진의 기능을 활용할 수 있다.
원문에서 자세히 보기: Ollama Releases
오픈AI, 차세대 AI 모델 ‘아스트라’ 발표
오픈AI는 차세대 AI 모델인 ‘아스트라’를 공개했다. 이 모델은 동일한 신경망을 반복 활용해 작은 규모의 모델에서도 복잡한 작업을 수행할 수 있도록 설계됐다. 그러나 내부 계산이 증가함에 따라 모델의 행동 모니터링과 위험 신호를 포착하는 것이 어려워질 가능성이 제기되고 있다. 이러한 점에서 모델의 성능 향상과 함께 새로운 안전성 문제가 부각되고 있다.
참고 출처 (3개 매체 종합)
구글, Gemini 3.8 Flash 모델 출시
구글이 Gemini 3.8 Flash 모델을 출시하며 새로운 사고 수준을 지원하는 ‘gemini-3.8-flash’를 소개했습니다.
원문에서 자세히 보기: Simon Willison
에이전틱 AI의 기업 배치 확대: 작동 안전성 확보의 도전
에이전틱 AI는 80%의 포춘 500 기업에 도입되었지만, 의미 있는 규모로 확장하는 데 어려움을 겪고 있다.
원문에서 자세히 보기: MIT Technology Review
디퓨전과 AR 결합으로 3.85배 가속된 OCR 모델
AR과 block diffusion을 결합한 OCR 모델로 품질 손실 없이 3.85배의 디코딩 속도 향상.
원문에서 자세히 보기: GeekNews (전체)
ChatGPT 페이지, 향상된 대화 기능과 Deep research 제공
ChatGPT 페이지가 AI 대화 기능, 사진 및 웹 검색 옵션을 추가하여 사용자 경험을 향상.
원문에서 자세히 보기: GeekNews (전체)
Polars 2.0rc1 – 성능 및 API 개선 중심의 첫 릴리스 후보
Polars 2.0rc1에서 스트리밍 엔진으로 메모리 효율성 및 성능을 5배 향상.
원문에서 자세히 보기: GeekNews (전체)
실시간 반응하는 인터랙티브 영상 생성 AI 개발
텐센트가 실시간 반응하는 인터랙티브 영상 생성 AI ‘H3-월드’를 공개했습니다.
원문에서 자세히 보기: AI Times
마인드로직, AI 온이음 사업 선정 및 교육 서비스 제공
마인드로직이 AI 온이음 사업에 선정되어 12만 명에게 교육 서비스를 제공합니다.
원문에서 자세히 보기: AI Times
.name 3단계 도메인 폐지, ICANN 승인
.name 3단계 도메인이 ICANN에 의해 폐지 승인됨, 25년 운영 종료.
원문에서 자세히 보기: GeekNews (전체)
인월드 AI, 감정 이해 가능한 차세대 음성 생성 모델 발표
인월드 AI가 실제 감정을 이해하는 음성 생성 모델을 출시했습니다.
원문에서 자세히 보기: AI Times
LLM의 지속학습 ‘팰컨’ 프레임워크로 업그레이드
LLM의 지속학습을 위한 ‘팰컨’ 프레임워크가 공개되었습니다.
원문에서 자세히 보기: AI Times