SOWN - Daily News

SomeWhere Olny We Know

Daily News #2026-08-27



  • Transformers v5.16.0 업데이트 내용
  • Ollama v0.33.0 업데이트 내용
  • vLLM v0.28.0 출시 상세
  • llama.cpp b10635 버전 공개 요약
  • Claude Code 버전 2.1.246의 주요 변경 사항
  • 피지컬 AI 모델 공개, 물리 세상 이해를 목표로 한 새로운 접근
  • OpenAI, 자사 인공지능 칩 ‘Jalapeño’ 공개
  • NVIDIA와 스페이스X의 파트너십
  • 사이버 보안 특화 AI 파운데이션 모델 개발 사업 참여팀 공모 완료
  • 퍼플렉시티, 클라우드 없이 AI 에이전트를 구동하는 ‘포터블 컴퓨터’ 공개
  • 아마존, 완전 자동화된 배송 센터 개발 착수
  • Runable, AI 에이전트를 통한 비즈니스 성장 가능성 입증
  • 자기 코드 오류를 디버깅 할 수 있는 AI 에이전트의 실험
  • AI 에이전트 메모리 구축을 위한 실용 가이드
  • PydanticAI로 안전한 프로덕션 AI 에이전트 구축하기
  • 앤트로픽, ‘클로드’의 채팅 기능과 ‘코워크’ 통합 발표
  • AI의 위험에 대한 빌 게이츠의 우려
  • AI 개발과 수수께끼 테스트의 연결
  • AI가 작성한 1M LOC로 개발된 신뢰할 수 있는 소프트웨어
  • 버즈니, 기업용 바이브 코딩 플랫폼 ‘세이코드’ 정식 출시

Transformers v5.16.0 업데이트 내용

버전 5.16.0에서는 Qwen4-Exp 모델과 Granite Speech 5.0 Turbo CTC 모델이 추가되었다. Qwen4-Exp는 Qwen3.5의 하이브리드 텍스트 및 멀티모달 아키텍처를 기반으로 하며, GatedResidual, Qwen Sparse Attention, Per-Layer Embedding의 세 가지 주요 구성 요소로 이루어진다. GatedResidual은 하이퍼 연결과 GatedNorm을 조합한 잔차 아키텍처로, 각 블록 출력의 재주입을 제어한다. Qwen Sparse Attention은 블록 수준 선택을 통해 메모리 로컬리티를 향상시키며, 긴 시퀀스의 추론 효율성을 크게 개선한다. Granite Speech 5.0 Turbo CTC는 경량화된 컨포머 인코더 모델이며, 약 470M의 파라미터를 가진다. 이 업데이트는 여러 자연어 처리 및 음성 인식 작업에 적용 가능하다.

원문에서 자세히 보기: Transformers Releases

Ollama v0.33.0 업데이트 내용

이번 버전에서는 Claude Desktop과 Ollama의 통합이 간소화되어, 개발자들이 쉽게 제3자 게이트웨이 제공자로 구성할 수 있게 되었다. 개선된 캐시 시스템으로는 긴 프리필을 취소한 클라이언트에서 발생하던 중단 현상이 수정되었으며, 취소된 프리필은 모든 복원 지점을 기록하여 재시작이 아닌 중단 지점에서 재개된다. 또한, 프리필이 실패한 복원 지점은 기록되지 않도록 조정되어, 모형의 재처리를 최소화한다. 그 외에도 DeepSeek Harness 론처의 명령어 지원과 macOS 특정 가정으로 인한 기본 패키징 오류가 수정되었다. 한국 개발자는 이러한 업데이트를 통해 Claude Desktop과 Ollama를 연동하여 새로운 기능을 활용할 수 있다.

원문에서 자세히 보기: Ollama Releases

vLLM v0.28.0 출시 상세

vLLM v0.28.0은 584개의 커밋과 270명의 기여자가 포함되어 있으며, 76명이 신규 기여자로 참여하였다. Kimi-K3에 대한 주요 최적화를 통해 성능을 크게 향상시켰으며, ROCm에 대한 지원이 추가되었다. DeepSeek V4에서는 희소 MLA가 전방위적으로 작동하도록 개선되었고, 모델 러너 V2는 여러 기능이 추가되어 발전하였다. 디스크 오프로드 지원을 포함한 계층적 KV 캐시 오프로드 기술이 도입되었으며, Python 휠 및 Docker 이미지도 제공된다. CUDA 13.0 및 ROCm에 맞춘 설치 옵션이 마련되어 있다. 개발자는 이 버전을 통해 고성능 프레임워크를 활용한 AI 모델을 쉽게 구축할 수 있다.

원문에서 자세히 보기: vLLM Releases

llama.cpp b10635 버전 공개 요약

이번 버전에서는 GPU 아키텍처 sm_60에서 MoE에 대한 mmq가 방지되었고, dp4a 및 이전 버전을 위한 mmq-config-pascal이 복제되었습니다. 또한, Q2_K, Q4_K, Q5_K, Q6_K의 비 dp4a Pascal에서 점유율이 감소되었습니다. 지원되는 플랫폼은 macOS, Linux, Android, Windows, openEuler로 다양합니다. 각 플랫폼에 따라 지원되는 CPU 및 GPU 기능이 상이하며, 특히 Windows에서는 CUDA 12 및 13 버전에 대한 DLL이 포함되어 있습니다. 한국 개발자는 다양한 플랫폼에서 성능 최적화를 위한 코드를 테스트할 수 있다.

원문에서 자세히 보기: llama.cpp Releases

Claude Code 버전 2.1.246의 주요 변경 사항

버전 2.1.246에서는 Bash allow 규칙에 와일드카드가 있을 경우의 경고 메시지가 추가되었으며, /permissions에 자동 모드 분류 규칙을 보고 수정할 수 있는 탭이 추가됐다. 각 회전의 완료 시간도 표시되도록 개선되었고, 전체화면 모드에서 터미널 크기 조정 후 빈 전사가 나타나는 문제를 수정하였다. 긴 단일 행의 diff가 있을 경우 느린 전사의 속도 저하 문제와 중단된 명령의 보고 방법도 개선되었다. 또한, 백그라운드 세션과 관련된 여러 오류가 수정되었고, 플러그인 설치 및 업데이트 과정에서도 여러 문제가 해결되었다. 이 업데이트는 정상적인 사용에 도움이 될 것이다.

원문에서 자세히 보기: Claude Code Releases

피지컬 AI 모델 공개, 물리 세상 이해를 목표로 한 새로운 접근

신생 AI 스타트업 액셀러레이티드 언더스탠딩이 기존의 트랜스포머 아키텍처와 월드 모델을 넘어서 ‘4D 시공간 궤적 예측’이라는 새로운 AI 모델을 개발했다고 발표했다. 이 모델은 물리 법칙을 이해하고 시뮬레이션하는 데 중점을 두며, 창립자인 아니마 아난드쿠마르와 베네딕트 제닉은 이 혁신적인 접근이 더욱 정교한 데이터 해석을 가능하게 할 것이라고 강조했다. 아난드쿠마르는 과거 20년간 AI 연구에 참여하면서, 이를 사용해 물리적 현상들을 모델링하고 있다. 해당 프로젝트는 제프 베이조스의 대형 AI 프로젝트를 거절한 연구진의 독자적인 노선의 일환으로 자리잡고 있다.

참고 출처 (2개 매체 종합)

OpenAI, 자사 인공지능 칩 ‘Jalapeño’ 공개

OpenAI가 자신들의 첫 번째 인공지능 전용 칩인 ‘Jalapeño’를 공개하며 NVIDIA의 기존 칩보다 뛰어난 성능을 기록했다고 전했다. Jalapeño는 Hot Chips 컨퍼런스에서 공개되었으며, 다양한 테스트에서 NVIDIA의 Blackwell 및 Rubin 칩보다 높아진 처리량과 에너지 효율성을 보여주었다. 이 새로운 칩은 OpenAI가 자사의 AI 모델을 지원하는 데 사용될 예정이며, 비용 절감에도 기여할 것으로 예상된다. OpenAI는 이 칩을 Broadcom과 협력하여 개발했다.

참고 출처 (3개 매체 종합)

NVIDIA와 스페이스X의 파트너십

NVIDIA가 스페이스X와 협력하여 자사의 CPU를 우주로 발사한 사실이 보도되었다. 이 파트너십은 우주에서의 계산 능력을 향상시키는 목적을 가지고 있으며, 우주 탐사와 AI 분야에서의 혁신을 촉진할 것으로 기대된다. 현재 AI 시장에서 다른 경쟁업체들이 저렴한 모델을 내놓고 있는 상황에서, Anthropic의 모델은 어려움을 겪고 있는 것으로 보인다. 이러한 맥락에서, NVIDIA와 스페이스X의 협력은 향후 AI 모델 개발에도 중요한 영향을 미칠 것으로 예상된다.

참고 출처 (2개 매체 종합)

사이버 보안 특화 AI 파운데이션 모델 개발 사업 참여팀 공모 완료

사이버 보안 특화 AI 파운데이션 모델 개발 사업 참여팀 공모가 SK텔레콤과 네이버클라우드로 확정됐다.

원문에서 자세히 보기: AI Times

퍼플렉시티, 클라우드 없이 AI 에이전트를 구동하는 ‘포터블 컴퓨터’ 공개

퍼플렉시티가 클라우드 없이 사용자 기기에서 AI 에이전트를 구동하는 ‘포터블 컴퓨터’를 발표했다.

원문에서 자세히 보기: AI Times

아마존, 완전 자동화된 배송 센터 개발 착수

아마존이 자동화된 배송 센터를 개발하기 위해 Project Tetromino를 착수했다.

원문에서 자세히 보기: TLDR Tech

Runable, AI 에이전트를 통한 비즈니스 성장 가능성 입증

Runable은 90일간 유료 고객에서 60%의 토큰 사용량을 기록했다고 밝혔습니다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

자기 코드 오류를 디버깅 할 수 있는 AI 에이전트의 실험

AI 에이전트가 6시간 동안 코드 버그를 스스로 수정한 실험 결과가 발표되었습니다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

AI 에이전트 메모리 구축을 위한 실용 가이드

AI 에이전트 구축을 위한 신뢰성 있는 메모리 시스템 설계 가이드가 제시되었습니다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

PydanticAI로 안전한 프로덕션 AI 에이전트 구축하기

PydanticAI를 활용한 안전한 프로덕션 AI 에이전트 구축법이 소개되었습니다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

앤트로픽, ‘클로드’의 채팅 기능과 ‘코워크’ 통합 발표

앤트로픽이 ‘클로드’와 ‘코워크’의 메모리 체계를 통합하여 사용자 편의성을 높였다.

원문에서 자세히 보기: AI Times

AI의 위험에 대한 빌 게이츠의 우려

빌 게이츠가 AI의 위험 임계점 초과 시 발생할 수 있는 문제에 대해 경고하였다.

원문에서 자세히 보기: MIT Technology Review

AI 개발과 수수께끼 테스트의 연결

AI 모델이 퍼즐과 게임을 통해 테스트되고 있다는 중요한 발견이 소개되었다.

원문에서 자세히 보기: MIT Technology Review

AI가 작성한 1M LOC로 개발된 신뢰할 수 있는 소프트웨어

AI가 개발한 1백만 LOC코드로 신뢰할 수 있는 소프트웨어가 탄생했다.

원문에서 자세히 보기: Simon Willison

버즈니, 기업용 바이브 코딩 플랫폼 ‘세이코드’ 정식 출시

버즈니가 기업용 바이브 코딩 플랫폼 ‘세이코드’를 정식 출시했다.

원문에서 자세히 보기: AI Times