- HrmTextForCausalLM 모델 지원 추가 및 변경 사항
- Vercel AI SDK 3.0.12 패치 변경 사항
- LiteLLM v1.103.0-dev.1 출시 및 수정 사항
- Claude Code v2.1.273 업데이트 요약
- 미국 내 노인을 위한 무료 ChatGPT 워크숍 개최
- NVIDIA NVLink 6의 AI 공장 내 다층 복원력 제공
- Google, Gemini 3.8 Live 모델 출시
- OpenAI Codex Multi Agents v2, 모델 지정 가능해져
- LangChain 1.4.1 버전 릴리스 노트
- vLLM 프로토타입 0.2.0 버전 출시
- 새로운 시스템 원 모델 ‘Jev’ 출시
- AIUC의 CEO와의 인터뷰 및 Appwrite에 대한 소개
- Hugging Face CEO, OpenAI 모델 침입 사건 대응 요구
- Good Start Labs, 기차 게임 AI 훈련으로 성과 달성
- 클로드 코드, 개발자들 사이에서 논란의 중심에
- AI로 인한 인류 멸종 시나리오, 연구자들의 우려 높아져
- Lightfield, 자가 업데이트 CRM으로 비즈니스 혁신
- AI 하드웨어, 대규모 학습에서 추론 수요로 전환
- 구글과 연구진, 초파리 뇌 지도 완성
- 인간 세포로 구성된 뇌를 가진 생쥐의 연구
HrmTextForCausalLM 모델 지원 추가 및 변경 사항
이번 업데이트에서는 HrmTextForCausalLM(DFM Mimir 1B) 모델 지원이 추가되었다. 이 모델은 같은 토큰 스트림에서 두 개의 변환기 스택(저주파, 고주파)을 번갈아 가며 실행한다. 새로운 작동 방식으로 fused gqkv 프로젝션을 위한 작성자, sigmoid 게이트 텐서가 포함되었으며, KV 캐시는 128 레이어를 유지할 수 있다. 업데이트는 또한 hrm_text 메타데이터를 위한 gguf_writer 메서드 추가, 여러 코드 구현의 부분적인 AI 자동 생성을 포함한다. 다만, causal attention만 지원하며 prefix-LM 모드는 구현되지 않았다. 한국 개발자는 이 새로운 HrmTextForCausalLM 기능을 활용하여 특정 어플리케이션에 맞게 모델 학습 및 튜닝을 진행할 수 있다.
원문에서 자세히 보기: llama.cpp Releases
Vercel AI SDK 3.0.12 패치 변경 사항
Vercel AI SDK의 최신 버전 3.0.12에서는 여러 종속성이 업데이트 되었다. 이번 패치에서는 @ai-sdk/openai-compatible의 버전이 3.0.50으로 업데이트 되었고, @ai-sdk/provider-utils는 5.0.42, @ai-sdk/provider는 4.0.16으로 각각 버전이 변경되었다. 다른 업데이트된 종속성으로는 11b4c2d, 91c2128, 2cd80b3, d06bb2a, 123d71f, 2fa5e0e가 포함된다. 이러한 변경 사항은 개발자들이 SDK의 최신 기능과 안정성을 반영할 수 있도록 한다. 한국 개발자는 업데이트된 SDK를 통해 최신 AI 기능을 활용한 프로젝트 개발에 적용할 수 있다.
원문에서 자세히 보기: Vercel AI SDK Releases
LiteLLM v1.103.0-dev.1 출시 및 수정 사항
LiteLLM의 새로운 Docker 이미지 버전 v1.103.0-dev.1이 출시되었으며, 모든 이미지는 cosign으로 서명됩니다. 사용자는 고정 커밋 해시를 통해 서명을 검증하는 것이 권장됩니다. 이번 업데이트에서는 응답 처리 개선, OAuth 위임 요구사항 추가, S3 지원 파일 삭제 및 목록화 기능 등의 다양한 수정 사항이 포함되었습니다. 또한, 로깅의 효율성을 높이고, 관리자 노출을 제한하는 UI 수정이 이루어졌습니다. 코드를 관리하는 각종 CI 작업도 수행되어 내부 스테이징이 메인으로 프로모션되었습니다. 한국 개발자는 이 버전의 개선 사항을 활용하여 자신의 애플리케이션에 적용할 수 있는 방법을 모색할 수 있다.
원문에서 자세히 보기: LiteLLM Releases
Claude Code v2.1.273 업데이트 요약
이번 버전에서는 LLM 게이트웨이를 위한 새로운 요청 헤더가 추가되었으며, MCP 서버가 세션 중단 시 자동 재연결이 실패할 경우 알림이 제공된다. 사용자는 Claude 앱에서 원격 제어 세션을 포크하여 백그라운드 세션으로 실행할 수 있다. 여러 버그 수정이 포함되어 있으며, 예를 들어 Bash 명령어의 권한 검사와 관련된 문제가 해결되었다. 또한, 비즈니스 설정이 적용된 경우 특정 서버 관리 설정이 무시되는 오류와, 구글 클라우드 및 앱의 인증 오류 메시지가 개선되었다. SDK 출력 시 서브 에이전트의 메시지가 누락되는 문제도 해결되었다. 이번 업데이트를 통해 클라우드 기능 활용에 기여할 수 있다.
원문에서 자세히 보기: Claude Code Releases
미국 내 노인을 위한 무료 ChatGPT 워크숍 개최
OpenAI와 AARP가 미국 10개 도시에서 1,000명의 노인을 대상으로 무료로 ChatGPT 워크숍을 진행한다. 이 프로그램은 참가자들이 실용적인 AI 기술을 안전하게 습득할 수 있도록 지원하며, 노인들이 일상생활에서 AI를 활용할 수 있도록 도와준다. 워크숍은 대면 형태로 진행되며, 노인들이 AI의 사용법을 직접 배우고 실습할 기회를 제공한다. 이러한 활동은 노인들의 디지털 전문가 양성에 기여할 것으로 기대된다. 한국 개발자는 이와 유사한 프로그램을 기획하여 지역사회 지원에 활용할 수 있다.
원문에서 자세히 보기: OpenAI News
NVIDIA NVLink 6의 AI 공장 내 다층 복원력 제공
NVIDIA NVLink 6는 대규모 AI 공장의 연속적 출력 극대화를 위한 다층 복원력을 지원한다. 대규모 AI 훈련에서 클러스터 내 모든 GPU의 연결을 강화하고 연산 효율성을 개선한다. 이 기술은 개별 GPU의 장애 시에도 시스템 전체가 계속 운영될 수 있도록 하여 가용성을 높이는 데 기여한다. NVLink 6는 높은 대역폭과 낮은 지연 시간으로 신속한 데이터 전송을 가능하게 함으로써 AI 작업의 성능을 극대화한다. 이러한 기능은 AI 개발자가 더 효율적인 시스템 설계를 할 수 있도록 돕는다.
원문에서 자세히 보기: NVIDIA Technical Blog
Google, Gemini 3.8 Live 모델 출시
구글은 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking이라는 두 가지 새로운 음성 대화 모델을 출시했다. 이 모델들은 이전 모델보다 향상된 지능과 병렬 추론 능력을 보유하고 있으며, 사용자들은 브라우저를 통해 음성 대화를 시작할 수 있다. 특히, Gemini 3.8 Live는 시세가 시간당 1.38달러로 OpenAI의 유사 모델보다 상당히 저렴하다. 이러한 모델들은 음성 인식 및 실시간 상호작용 기능을 개선하는 데 초점을 맞추고 있다.
참고 출처 (4개 매체 종합)
OpenAI Codex Multi Agents v2, 모델 지정 가능해져
OpenAI의 Codex Multi Agents v2에서는 사용자들이 서브 에이전트가 사용할 모델을 직접 지정할 수 있게 되었다. 이 시스템에서는 고성능 모델인 GPT-5.6 Sol이 전체 작업을 조정하고, 저비용의 GPT-5.6 Luna가 반복적인 작업을 수행하도록 설정할 수 있다. 이를 통해 토큰 사용량과 응답 속도를 최적화할 수 있으며, 궁극적으로 비용 절감과 작업 효율성을 크게 향상시킬 수 있다. 이 기술은 생성형 AI와 멀티‑에이전트 시스템에 중요한 발전으로 평가된다.
참고 출처 (3개 매체 종합)
LangChain 1.4.1 버전 릴리스 노트
LangChain의 1.4.1 버전이 발표되었으며, 주요 변경 사항으로는 커스텀 MCP 객체 인수 보존 문제 수정과 InterruptOnConfig 문서의 정확성 개선이 포함된다. 이 버전은 이전 1.4.0 버전의 업데이트로, 주로 버그 수정을 다루고 있다. 사용자는 이러한 수정 사항을 통해 더 안정적인 환경에서 LangChain을 사용할 수 있다. 한국 개발자는 수정된 기능을 검토하여 기존 프로젝트에 적용할 수 있다.
원문에서 자세히 보기: LangChain Releases
vLLM 프로토타입 0.2.0 버전 출시
vLLM 프로젝트의 새로운 프로토타입 버전 0.2.0이 출시되었으며, 이 버전은 PR #56538 CI에서 검증을 받았습니다. 최종 커밋 해시는 ‘fa2a26f’로 확인되었습니다. 이 업데이트는 버전 관리 및 품질 보증 절차를 강조하며, 개발자들이 코드 품질을 검토할 수 있는 기회를 제공합니다. 한국 개발자는 이 업데이트를 참고하여 vLLM의 기능을 더 깊이 이해하고, 관련 프로젝트에 적용할 수 있습니다.
원문에서 자세히 보기: vLLM Releases
새로운 시스템 원 모델 ‘Jev’ 출시
Jev는 기존의 대형 언어 모델에 비해 두 배 이상 빠르고 효율적으로 시스템 원(Task) 작업에서 유사한 수준의 지능을 달성하는 시스템 원 모델이다. 이 모델은 소프트웨어가 직접 사용할 수 있는 빠르고 구조화된 의사 결정을 내리도록 설계되었다. Jev는 구조화된 출력을 최적화하여 생성하지 않는 성격을 가지고 있으며, 현재 얼리 액세스 형태로 제공되고 있다.
참고 출처 (2개 매체 종합)
AIUC의 CEO와의 인터뷰 및 Appwrite에 대한 소개
AIUC의 CEO와의 인터뷰가 진행되었으며, 이는 그들의 시리즈 A 투자와 관련된 내용으로 보인다. 또한 오픈 소스 클라우드 솔루션인 Appwrite에 대한 정보가 제공되었고, 이는 에이전트 및 개발자들이 사용할 수 있는 플랫폼이다. 두 사건이 각각 기술 스타트업의 성장과 개발자 커뮤니티의 지원을 강조하고 있다.
참고 출처 (2개 매체 종합)
Hugging Face CEO, OpenAI 모델 침입 사건 대응 요구
Hugging Face CEO가 OpenAI 모델 침입 사건 대응을 위해 1억 달러의 컴퓨팅 자원을 요구했다.
원문에서 자세히 보기: GeekNews (전체)
Good Start Labs, 기차 게임 AI 훈련으로 성과 달성
Good Start Labs가 기차 게임 AI 훈련을 통해 재무 연구 성과를 향상시켰다.
원문에서 자세히 보기: Latent Space
클로드 코드, 개발자들 사이에서 논란의 중심에
클로드 코드 사용 개발자들 사이에서 오픈소스 AI 모델 연결과 관련한 논란이 발생했다.
원문에서 자세히 보기: AI Times
AI로 인한 인류 멸종 시나리오, 연구자들의 우려 높아져
연구자 조사 결과, AI 멸종 시나리오에 대한 우려가 18%에 달한다고 보고되었습니다.
원문에서 자세히 보기: THE DECODER
Lightfield, 자가 업데이트 CRM으로 비즈니스 혁신
Lightfield는 이메일, 통화, 미팅 데이터를 자동으로 업데이트하는 CRM이다.
원문에서 자세히 보기: TLDR Tech
AI 하드웨어, 대규모 학습에서 추론 수요로 전환
AI 하드웨어가 대규모 학습에서 급증하는 추론 수요에 맞춰 중심을 이동하고 있다.
원문에서 자세히 보기: GeekNews (전체)
구글과 연구진, 초파리 뇌 지도 완성
구글 연구팀이 초파리 뇌의 뉴런을 완벽하게 166,000개 맵핑하였다.
원문에서 자세히 보기: TLDR Tech
인간 세포로 구성된 뇌를 가진 생쥐의 연구
거의 절반의 뇌를 인간 세포로 대체한 생쥐를 연구한 실험이 진행됐다.
원문에서 자세히 보기: MIT Technology Review