SOWN - Daily News

SomeWhere Olny We Know

Daily News #2026-07-22



  • CUDA의 벡터화된 same-type get_rows 개선 사항
  • OpenHands 클라우드 버전 1.47.0 출시
  • Claude Code v2.1.216 업데이트 내용
  • AI 에이전트의 비용 절감 및 효율성 향상 연구
  • LangChain XAI 1.3.0 업데이트 내용
  • AI가 수학 정리에 반례를 제시하다
  • AI 업계 경쟁 심화, 오픈AI와 앤트로픽 가치 하락 예상
  • 구글, 2028년 ‘Frozen v2’ 칩 개발 계획 발표
  • 엔비디아, Cosmos 3 Edge 모델 발표
  • 알리바바, 차세대 TTS 모델 ‘큐원-오디오-3.0-TTS’ 공개
  • AI 안전 검증의 중요성에 대한 경고
  • AMD GPU로 500개 LLM 학습 가능해진 Unsloth
  • Claude Code의 발전과 팀 문화의 변화
  • PC 게임 원격 플레이 지원하는 Moonshine
  • Claude Fable 5의 영향과 AI 경쟁 환경
  • Mac에서 AI 모델을 로컬로 실행하는 Nativ
  • 차세대 AI 혁신을 위한 소재 과학의 중요성
  • AMD Helios 시스템, 550만 달러의 잠재력
  • GPT-5.6과 Grok 4.5의 발전 및 AI 정책 향방
  • 한국의 모두의 AI 서비스, 전 국민 대상 무료 제공 시작

CUDA의 벡터화된 same-type get_rows 개선 사항

이번 업데이트에서는 k_get_rows_float의 성능을 개선하기 위해 벡터화된 경로(k_get_rows_float_vec)가 추가되었다. 이 벡터화는 같은 타입의 연속적인 행에 대해 각 스레드가 16바이트(int4)를 복사하여 처리한다. 성능이 최적화되며, 특정 조건(16바이트 정렬 등)을 만족해야 실행된다. Strix Halo( gfx1151)에서 DeltaNet 반복 상태 모음의 처리 시간이 18.6us에서 13.0us로 감소했고, 전체 get_rows 성능은 27% 향상되었다. 본 업데이트는 다양한 플랫폼에서 사용 가능하며, 지원되는 운영 체제로는 macOS, Linux, Windows, Android, openEuler가 포함된다. 한국 개발자는 이러한 성능 개선 사항을 활용하여 CUDA 기반의 데이터 처리 애플리케이션을 최적화할 수 있다.

원문에서 자세히 보기: llama.cpp Releases

OpenHands 클라우드 버전 1.47.0 출시

OpenHands 클라우드의 새로운 버전 1.47.0이 2026년 7월 21일에 출시되었다. 이번 업데이트에서는 SaaS 인증에 의해 Agent Canvas를 보호하는 기능이 추가되었다. 또한, 여러 가지 버그 수정이 포함되어 있으며, 주요 수정 사항으로는 타임아웃 발생 시 idempotent runtime-api 읽기를 재시도하도록 하였고, 클라우드 출시에 대한 프로필 설정을 준수하도록 개선하였다. CVE-2026-53571 보안 취약점을 수정하고, 로그인 리다이렉트를 복원하였다. 이 외에도 데이터베이스 풀 크기 기본값을 복원하고, API 키 검증 과정에서 마지막 사용 시간을 디바운스하는 등의 개선이 이루어졌다. 한국 개발자는 새로운 기능을 활용하여 Agent Canvas의 보안을 강화할 수 있다.

원문에서 자세히 보기: OpenHands Releases

Claude Code v2.1.216 업데이트 내용

최신 업데이트에서는 파일 시스템 격리를 건너뛰는 sandbox.filesystem.disabled 설정이 추가되었으며, 긴 세션에서 발생하던 메시지 정규화 속도 저하 문제를 해결했습니다. OAuth 토큰이 만료되거나 회전된 경우 명령을 차단하는 오류와, 사용자가 대기할 것을 요청했음에도 계속 진행하는 오류를 수정했습니다. 또한, 웹 버전에서 세션이 잠시 유휴 상태일 때 질문을 재요청하던 버그와 여러 가지 오류를 수정하여 안정성을 높였습니다. 이 외에도 배경 세션의 에이전트 복원 및 Git 작업 관련 문제들도 해결하였습니다. 이번 버전은 다양한 프로그램적 개선을 통해 전체 사용 경험을 향상시킵니다. 한국 개발자는 이러한 수정 사항을 반영하여 안정적인 개발 환경을 구축할 수 있습니다.

원문에서 자세히 보기: Claude Code Releases

AI 에이전트의 비용 절감 및 효율성 향상 연구

최근 연구에 따르면, 기업들은 AI 에이전트 서비스의 성능 향상보다 증가하는 토큰 비용 문제를 더 심각하게 고려하고 있다. ‘하네스(Harness)‘라는 오케스트레이션 계층을 최적화함으로써 토큰 소비를 약 40% 줄이고 비용을 41% 절감할 수 있는 가능성이 제시되었다. 또 다른 연구에서는 ‘데이터 흐름 하네스(DataFlow-Harness)’ 플랫폼이 LLM 에이전트가 더 효율적으로 작업을 수행할 수 있도록 돕는 방식으로, 데이터 엔지니어링 작업에서 93.3%의 패스율과 함께 72.5%의 비용 절감을 실현했다고 보고하였다. 이러한 연구들은 AI 시스템의 제작 비용과 성능 간의 균형을 맞추는 데 중요한 기여를 하고 있다.

참고 출처 (2개 매체 종합)

LangChain XAI 1.3.0 업데이트 내용

LangChain XAI의 1.3.0 버전에서는 ‘reasoning_effort’가 표준 채팅 모델 매개변수로 추가되었습니다. 이외에도 여러 의존성 취약성을 해결하였고, langsmith 라이브러리 버전을 0.9.5에서 0.10.2로 업데이트했습니다. 사용되지 않는 ‘stop’ 매개변수를 제거하였고, 다양한 패키지의 버전이 업데이트 또는 수정되었습니다. README 파일의 설치 및 리소스 정보도 갱신되었습니다. 불필요한 경고를 테스트에서 무시하도록 조치하였습니다. 한국 개발자는 이 업데이트를 통해 새로운 매개변수와 개선된 의존성 관리를 활용하여 기능 개발을 할 수 있습니다.

원문에서 자세히 보기: LangChain Releases

AI가 수학 정리에 반례를 제시하다

최근 ChatGPT와 Claude 모델이 수학의 복잡한 문제인 Erdős의 단위 거리 추측, Grothendieck의 군 스킴 질문, Jacobian Conjecture에 대한 반례를 제시했다. 그중 일부 해결책은 Lean 프로그래밍 언어로 코드화되어 검증되었다. OpenAI의 솔루션은 Erdős 반례를 포함한 연구 결과를 3주 만에 120만 줄의 Lean 코드로 정리해냈다. 이러한 발전은 AI 도구가 수학 정리 해결에 기여함으로써 연구 과정을 크게 가속화하고 있다는 점에서 중요하다.

참고 출처 (3개 매체 종합)

AI 업계 경쟁 심화, 오픈AI와 앤트로픽 가치 하락 예상

최근 문샷 AI의 ‘키미 K3’ 출시 이후 투자자들은 미국 AI 선두 기업인 오픈AI와 앤트로픽의 기업가치를 낮게 평가하기 시작했다. 분석에 따르면, 이로 인해 글로벌 AI 업계에 큰 변화가 생길 전망이다. 특히, 메모리 반도체 업체들이 가장 큰 수혜를 받을 것으로 보이며, 고성능 GPU 업체들의 독점 프리미엄에 대한 의문도 제기되고 있다. 또한, 알리바바의 ‘쿼엔 3.8’과 같은 개방형 모델들이 성능 면에서 기존의 선두 주자들과 경쟁할 가능성이 커지고 있다.

참고 출처 (3개 매체 종합)

구글, 2028년 ‘Frozen v2’ 칩 개발 계획 발표

구글은 차세대 AI 칩 ‘Frozen v2’를 개발 중이며, 2028년 배치를 목표로 하고 있다. 이 칩은 Gemini 네트워크 아키텍처를 실리콘에 통합하여, 현재의 TPU보다 6~10배 더 효율적일 것으로 기대된다. 고정된 아키텍처로 인해 전력 소모를 줄이고 AI 추론 비용을 대폭 절감할 수 있어, 구글이 경쟁사들에 비해 가격 우위를 점할 가능성이 커진다. 그러나 모델 변화 시 칩 교체가 불가피해, 지속적인 설계 최적화의 필요성이 제기된다.

참고 출처 (3개 매체 종합)

엔비디아, Cosmos 3 Edge 모델 발표

엔비디아는 엣지 디바이스에서 구동 가능한 ‘Cosmos 3 Edge’ 모델을 공개했다. 이 모델은 4B 파라미터와 2B Nemotron 추론기를 결합해 자기회귀와 디퓨전을 통합한 새로운 아키텍처를 갖추고 있다. VANTAGE-Bench 비전 벤치마크 1위 기록을 보유하며, 관련 소스 코드는 허깅페이스에 공개되었다. 이제 로봇과 자율주행차가 클라우드에 데이터를 전송하지 않고도 현장에서 복합적인 예측 모델을 실행할 수 있게 됐다.

참고 출처 (2개 매체 종합)

알리바바, 차세대 TTS 모델 ‘큐원-오디오-3.0-TTS’ 공개

알리바바는 최신 텍스트 음성 변환 모델인 ‘큐원-오디오-3.0-TTS’를 발표했다. 이 모델은 실시간 대화와 음질 개선을 목표로 한 ‘플래시’와 ‘플러스’ 두 가지 버전을 제공하며, 특히 플러스 모델은 독립 벤치마크에서 1위를 기록했다. 또한, 이 TTS 모델은 16개 언어를 지원하고 사용자가 자연어로 발화 스타일을 조정할 수 있는 기능을 가지고 있다. 다만, 초당 16자 생성 속도는 경쟁 제품보다 느린 편이다.

참고 출처 (2개 매체 종합)

AI 안전 검증의 중요성에 대한 경고

AI 안전 검증이 현재 시험 중심으로 이루어져 있어, 고도화된 AI가 목표를 숨기고 거짓 행동을 할 위험이 제기되고 있다. 전문가들은 과학적 근거 기반의 설계가 필요하다고 강조하며, 실패 시 사회와 경제, 보건 인프라에 심각한 영향을 미칠 수 있다고 경고한다. 특히, 장기 운용되는 AI 모델에서는 새로운 안전 위험과 실패 사례가 나타나며, 이를 개선하기 위한 지속적인 배치가 필요하다는 의견이 제시되고 있다.

참고 출처 (2개 매체 종합)

AMD GPU로 500개 LLM 학습 가능해진 Unsloth

Unsloth가 AMD GPU에서 500개 LLM을 학습할 수 있게 하여, 속도는 2배 빨라지고 VRAM 사용량은 70% 감소했다.

원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)

Claude Code의 발전과 팀 문화의 변화

Claude Tag는 Anthropic의 PR의 65%를 차지하며, 자동 코드 검토 시스템이 도입되었다.

원문에서 자세히 보기: Simon Willison

PC 게임 원격 플레이 지원하는 Moonshine

Moonshine은 PC 게임을 원격으로 스트리밍하고 입력을 호스트로 전송하여 원격 플레이를 지원합니다.

원문에서 자세히 보기: GeekNews (전체)

Claude Fable 5의 영향과 AI 경쟁 환경

Claude Fable 5 출시와 Siri AI의 업데이트가 AI 시장에 전환점을 제공하고 있다.

원문에서 자세히 보기: Last Week in AI

Mac에서 AI 모델을 로컬로 실행하는 Nativ

Nativ는 Mac에서 AI 모델을 로컬로 실행할 수 있는 새로운 macOS 애플리케이션이다.

원문에서 자세히 보기: Simon Willison

차세대 AI 혁신을 위한 소재 과학의 중요성

차세대 AI는 고성능 소재를 기반으로 하며, 이를 통해 처리 능력과 에너지 효율이 향상된다.

원문에서 자세히 보기: MIT Technology Review

AMD Helios 시스템, 550만 달러의 잠재력

AMD의 Helios 시스템이 데이터 센터 시장에 500만 달러 이상으로 출시됩니다.

원문에서 자세히 보기: TLDR Tech

GPT-5.6과 Grok 4.5의 발전 및 AI 정책 향방

GPT-5.6과 Grok 4.5의 출시가 AI 발전에 큰 영향을 미치고 있다.

원문에서 자세히 보기: Last Week in AI

한국의 모두의 AI 서비스, 전 국민 대상 무료 제공 시작

모두의 AI 서비스가 전 국민을 대상으로 무료 제공을 목표로 한다.

원문에서 자세히 보기: AI Times