7개의 글
온디바이스 AI와 클라우드 AI의 차이는 연산을 기기 안의 칩에서 하느냐, 외부 서버에서 하느냐에 있다. 온디바이스는 응답이 1초 이내로 빠르고 입력한 데이터가 기기 밖으로 나가지 않아 속도와 개인정보에서 유리한 반면, 복잡한 추론이나 긴 문서 분석은 여전히 클라우드가 낫다. 하나를 고르기보다 민감하고 빠른 일은 기기에서, 무겁고 복잡한 일은 클라우드에서 처리하도록 작업별로 나눠 쓰고 내 기기에 NPU가 있는지부터 확인하는 편이 낫다.
오픈AI가 GPT-6 아스트라 수요 폭증으로 월 200달러(약 29만9000원) 챗GPT 프로 요금제의 신규 가입과 업그레이드를 일시 중단했다. 중단은 신규 가입과 상위 업그레이드에만 적용되며 기존 프로 이용자와 API·플러스·Go 요금제는 영향이 없고, 재개 시점은 아직 미정이다. 지금 프로가 꼭 필요한지, API나 하위 요금제로 대체할 수 있는지, 다른 AI로 옮길 때의 전환 비용을 따져보는 게 먼저다.
구글이 2026년 9월 2일 취약점 탐지와 자동 패치에 특화한 제미나이 3.8 플래시 사이버를 공개하며 사이버젬 86.2% 같은 벤치마크와 크롬 패치 2.6배 등의 성과를 제시했다. 그러나 이 모델은 이중용도 위험 탓에 정부와 핵심 인프라 운영자 등 '신뢰할 수 있는 방어자'를 대상으로 한 페어윈드 프로그램으로만 제한 제공돼, 대부분의 실무자는 당장 쓸 수 없다. 도입을 검토한다면 접근 자격과 자사 환경으로의 성능 이전성, 자동 패치의 사람 검수 절차부터 확인하는 편이 낫다.
오픈AI가 미공개 모델 아스트라를 두고 컴퓨터 조작 능력이 인간 수준에 이르렀다고 밝혔다. 그러나 이 주장은 상당 부분 CEO 발언과 내부 벤치마크에 기대고 있고, 외부에서 검증된 성과는 Lean 4로 확인된 수학 증명 쪽이며 모델은 아직 일반에 공개되지 않았다. 자동화 도입을 검토한다면 독립 검증 여부와 실제 업무 환경, 권한·롤백 안전장치를 기준으로 지금 쓸 수 있는 도구부터 따지는 편이 낫다.
AI 영상 생성은 프레임 간 시간적 어텐션 때문에 이미지 생성보다 VRAM을 3~10배 더 써서, 32GB인 RTX 5090은 720p는 여유롭게 1080p는 빠듯하게 소화한다. 클라우드로 5090을 빌리면 시간당 약 0.56달러라 초기 비용 없이 필요한 만큼만 쓸 수 있다. 카드값 대비 손익분기는 약 3,500 GPU 시간이므로, 매일 장시간 반복 생성하거나 데이터를 로컬에 둬야 하는지가 구매 판단의 기준이 된다.
딥시크가 2026년 8월 6일경 API 요금의 "대폭 인상"을 예고했지만 인상 폭과 시행일은 공개하지 않았다. 초저가로 사용량이 폭증해 연산 자원을 감당하기 어려워진 결과로, 한 달 새 두 번째 요금 변경이며 인상 후에도 서구 경쟁사보다는 저렴할 가능성이 크다. 인상 전이라면 실제 사용량에 맞춘 충전과 캐시 히트 활용으로 비용을 줄일 수 있고, 챗GPT·클로드와 비교할 땐 가격만이 아니라 성능·안정성·데이터 처리 위치를 함께 따져야 한다.
딥시크가 8월 6일 API 요금을 조만간 대폭 올리겠다고 예고했지만 구체적 금액과 시행일은 공개하지 않았다. 저가 전략의 상징이던 딥시크가 방향을 튼 신호지만, 워낙 낮은 기반이라 인상 후에도 다른 서비스보다 쌀 가능성이 남아 있다. 전환은 실제 새 요금이 나온 뒤 자신의 사용량과 오프피크 활용, 데이터 정책을 따져 판단하는 편이 낫다.