AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

구글의 내비게이션 앱 웨이즈(Waze)가 제미나이(Gemini) AI를 통합한 새로운 기능들을 공개했다. 사용자 주행 이력 기반의 경로 추천, 대화형 목적지 검색, AI 기반 오토바이 전용 모드 등이 포함됐다. AI가 단순 경로 안내를 넘어 사용자 취

한국 SaaS 디렉토리 saaskr이 MCP 서버를 공개했다. Claude나 Cursor에서 자연어로 서비스 등록과 검색이 가능하다. 주간 자동 점검으로 유효한 서비스 링크만 관리한다.

Bun이 런타임 코드를 Zig에서 Rust로 전환하며 이를 Anthropic AI 모델의 성과로 홍보했다. Zig 창시자 앤드류 켈리는 이번 전환이 언어의 한계가 아니라 AI 에이전트 남용으로 인한 설계 실패의 결과라고 반박했다. AI 에이전트를 통한

주식 추천의 신뢰도를 확인하기 위해 예측 이력을 투명하게 기록하는 서비스가 등장했다. Claude와 ChatGPT 등 12개 AI 봇을 투입해 두 달간 주가 방향 예측 대결을 펼쳤다. REST API와 MCP 서버를 통해 누구나 자신의 AI 에이전트를

정치 커뮤니티의 가짜뉴스와 소모적 논쟁을 줄이기 위해 AI 팩트체크 기능을 도입했다. 단순 프롬프트의 한계를 넘어 사실 주장 추출, 스냅샷 보관, 멀티모달 컨텍스트 구조를 구축했다. Gemini 3.5 Flash와 3.1 Pro의 계층적 모델 구성과

최신 AI 모델에게 터미널 권한을 주면 복잡한 시스템 설정까지 빠르게 처리할 수 있다. 최근 gpt-5.6-sol 모델이 PowerShell의 변수 특성을 오해해 사용자 루트 폴더를 삭제하려 했다. 시스템 잠금 덕분에 전면 삭제는 면했지만, 일부 설정

AI 시대에 뒤처지면 영구적 하층민이 된다는 불안감이 확산하고 있다. 하지만 LLM은 초지능이 아니라 고급 자동완성이나 스마트 컴파일러 같은 도구에 가깝다. 코딩 에이전트는 생산성을 높이지만 인지 피로를 유발하며 저품질 코드를 양산하는 한계가 있다.

B2B 소프트웨어 검색 결과와 AI 답변 영역에 숏폼 동영상이 빠르게 진입하고 있다. 유튜브 쇼츠는 미국 내 475개 소프트웨어 검색어 상위 10위에 진입했으며 이 중 75%가 1위를 차지했다. 기업은 단순 영상 제작을 넘어 검색어 기반의 숏폼 재가공

ChatGPT 같은 AI 서비스의 핵심은 학습보다 답변을 내놓는 '추론' 과정에 있다. 요청 하나가 응답으로 돌아오기까지 데이터센터 내 15단계의 복잡한 경로를 통과한다. 2026년 기준 추론 비용이 전체 AI 컴퓨팅의 3분의 2를 차지하며 인프라 경

AI 에이전트가 단순한 업무 도구를 넘어 특정 업무 자체를 수행하고 판매하는 '에이전트 SaaS' 형태로 진화하고 있다. Slang AI와 same day는 전화 응대와 예약 관리 등 인적 자본이 투입되던 영역을 AI가 직접 처리하며 매출 손실을 방지

AI가 코드를 짜주는 시대가 오면서 개발 방식이 완전히 바뀌고 있다. 커밋된 코드의 42%가 AI 보조를 받았지만, 검증과 책임의 공백이라는 새로운 문제가 생겼다. 이제 엔지니어는 직접 구현하는 '내부 루프' 대신 배포를 결정하는 '외부 루프'를 소유

AI 에이전트를 운영하다 보면 모델 교체 시 성능과 비용 사이에서 고민하게 됩니다. 마케팅 웹사이트 제작 AI 'Ploy'가 클로드 오퍼스를 버리고 OpenAI의 GPT-5.6 솔로 전격 교체했습니다. 그 결과 작업 속도는 2.2배 빨라졌고 운영 비용

AI 코딩 에이전트는 사용자의 질문보다 시스템이 내부적으로 보내는 데이터 양이 훨씬 많다. Claude Code는 기본 33,000토큰을 사용하는 반면 OpenCode는 7,000토큰 수준이다. 서브에이전트 활용 시 비용이 4.2배까지 폭증하며 컨텍스

코리 닥터로우가 AI 사용 양상을 인간이 주도하는 '켄타우로스'와 AI가 인간을 보조로 쓰는 '리버스 켄타우로스'로 구분해 정의했다. 허스트(Hearst)의 AI 생성 도서 목록 사례를 통해 인간이 AI의 오류를 책임지는 '책임 흡수원'으로 전락한 구

LLM 운영을 위해 고가의 GPU 서버나 데이터센터 API에 의존하는 것이 일반적이다. Mesh LLM은 흩어진 GPU와 메모리를 하나로 묶어 OpenAI 호환 API로 제공한다. 0.5B부터 235B 규모의 모델까지 지원하며 P2P 방식으로 연산을

나이지리아 테러 조직 보코하람이 프런티어 AI 모델을 전투 및 작전 운영에 체계적으로 활용한 정황이 확인됐다. ChatGPT, Claude, Gemini 등 6종의 모델을 통해 폭발 장치 설계와 전술 계획을 수립했으며 전담 AI 조직을 운영해 지식을

오지 전용 인터넷으로 인식되던 위성 통신이 AI 인프라로 진화한다. SpaceX가 10만 기의 3세대 위성을 배치해 멀티기가비트 속도를 구현한다. 20ms 미만의 초저지연망을 통해 전 세계 수십억 개의 AI 장치를 연결한다.

AI 기업들이 인간을 능가하는 초지능을 먼저 갖기 위해 전속력으로 경쟁하고 있다. 이 경쟁이 인류 멸종이나 극단적인 권력 독점으로 이어질 수 있다는 경고가 나온다. 연구를 투명하게 공개하고 초지능 도달 시점을 2040년으로 늦추는 '플랜 A'가 대안으

누구나 ChatGPT나 Claude 같은 AI에게 먼저 질문을 던지는 시대가 되었다. 하지만 AI의 합의된 답변을 넘어선 고난도 질문은 여전히 인간의 실무 경험을 필요로 한다. 'AI에게 물어보라'는 조언이 전문적 통찰을 회피하는 수단으로 변질되는 현

코어위브와 네비우스가 하이퍼스케일러와의 대규모 계약과 엔비디아의 투자를 통해 GPU 인프라를 급격히 확장하고 있다. CKS, SUNK 등 전용 소프트웨어 스택을 통해 호퍼(Hopper) GPU 기준 50% 이상의 MFU(Model FLOPs Utili

웹 브라우저에서 3D 모델을 구현하기 위해 일일이 좌표를 수정하거나 외부 파일을 불러오는 작업은 번거롭다. RePolis(가상 도시 프로젝트)의 세계수 구현을 위해 Three.js 전용 GitHub Copilot 플러그인이 개발됐다. Sculpt DN

AI 2040의 초지능 시나리오가 물리적 현실과 공급망의 제약을 간과했다는 비판이 제기됐다. 저자는 ChatGPT의 가드레일 사례를 통해 기업 주도의 정렬이 아닌 사용자 중심의 로컬 AI 정렬을 주장했다. AI 실무자는 지능의 고도화보다 물리적 구현

AI 코딩 도구의 환각 현상을 이용해 악성 패키지를 설치하게 만드는 '슬롭스쿼팅(Slopsquatting)' 공격 방식이 제기됐다. 분석 결과 GPT-4 Turbo의 패키지 환각률은 3.59%였으나, 오픈소스 모델인 DeepSeek 1B는 13.63%

AI가 이미지 속 글자를 너무 완벽하게 읽어내는 시대가 됐다. 움직임과 가짜 메시지를 섞어 AI만 못 읽게 만드는 '고스트 폰트'가 공개됐다. 정지 화면으로는 내용을 알 수 없어 최신 AI 모델들도 해독에 어려움을 겪는다.

전국 수영장 시간표 같은 비정형 데이터를 LLM으로 자동 수집하려는 시도가 많다. Gemini-2.0-flash-lite로 600여 곳을 시도했으나 API 한도, 스키마 불일치, 원천 데이터 부재라는 세 가지 벽에 부딪혔다. 결국 모델 성능보다 데이터

LLM은 코드베이스의 기존 패턴을 학습해 다음 코드를 생성한다. 중복된 조건문과 임시 구현을 그대로 병합하면 모델은 이를 프로젝트 규칙으로 인식한다. 결국 나쁜 패턴이 코드베이스에 고착화되어 사람이 직접 수정해야 하는 상황이 발생한다.

한국 기업이 미국 증시에서 겪어온 고질적인 저평가 현상이 AI 열풍으로 깨지고 있습니다. SK하이닉스가 나스닥 데뷔를 통해 미국 역사상 최대 규모인 265억 달러(약 40조 원)를 조달했습니다. AI 칩의 핵심인 HBM 경쟁력을 앞세워 알리바바의 기존

AI 이미지 편집 시 배경이나 옷을 바꾸면 얼굴이 변하는 정체성 붕괴가 고질적 문제였다. Krea 2 Identity Edit은 12.9B 파라미터의 MMDiT 구조로 인물 고유 외형을 보존한다. SVD 최적화로 VRAM 사용량을 0.46GB까지 낮춰

PySpark/SQL 스타일 연산과 LLM 시맨틱 연산자를 통합한 쿼리 엔진 fenic이 공개됐다. 비정형 데이터를 구조화된 컬럼으로 변환하며, 데이터 파이프라인을 에이전트가 호출 가능한 타입 지정 도구로 전환한다.

Meta가 구형 DDR4 메모리를 최신 DDR5 서버에서 재사용할 수 있는 맞춤형 ASIC 'Vistara'를 개발했다. CXL 2.0/1.1 및 PCIe Gen5 x16 인터페이스를 통해 분리형 추론 서버 수를 최대 25% 줄였다. 메모리와 서버의