AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 코딩 도구의 보급으로 기존의 기술 면접 방식이 무력화되고 있다. 앤스로픽 등 주요 기업은 면접 내 AI 사용을 제한하며 기초 역량 검증으로 회귀 중이다. 도구적 숙련도보다 추론 능력과 설계 역량 중심의 라이브 테스트 비중이 확대된다.

LLM 추론의 핵심 병목은 연산 속도가 아니라 메모리 대역폭이다. 2016년형 제온 서버에서 ik_llama.cpp 최적화를 통해 Gemma 4 26B-A4B를 실행했다. 추측 디코딩과 MoE 캐시 최적화로 GPU 없이도 읽기 가능한 속도를 확보했다.

AI 코딩 도구로 배포 속도가 4배 빨라지며 기존 수동 SRE 관행이 한계에 봉착했다. Google은 AI 에이전트의 자율성을 4단계로 구분하고 안전 가드레일을 구축했다. 운영자는 이제 코드 리뷰어가 아닌, AI의 안전 경계를 설계하는 아키텍트로

그래미 어워즈를 주관하는 레코딩 아카데미의 하비 메이슨 주니어 CEO가 생성형 AI가 음악 산업에 미치는 영향과 대응 방안을 논의했습니다. 기술이 창작의 영역을 빠르게 잠식하는 가운데, 시상식의 공정성과 인간 예술가의 가치를 지키기 위한 고민이 깊어

알파벳이 AI 인프라와 컴퓨팅 능력을 강화하기 위해 800억 달러 규모의 자본을 조달합니다. 거대 AI 모델 구동에 필수적인 하드웨어 투자를 대폭 확대할 계획입니다.

맥북의 상태 모니터링, 팬 속도 조절, 잠자기 제어 기능을 하나로 통합한 무료 앱 UltraCat이 공개되었습니다. TG Pro, 암페타민 등 개별적으로 사용하던 유료 유틸리티의 핵심 기능을 한 곳에서 사용할 수 있습니다.

고성능 노트북 시장은 그동안 애플의 맥북 프로가 독주해 왔다. 마이크로소프트가 엔비디아와 협력해 128GB 통합 메모리를 갖춘 '서피스 랩탑 울트라'를 공개했다. 1200억 개의 파라미터를 가진 AI 모델을 클라우드 없이 로컬에서 돌리는 압도적 성능을

AI PC 시장이 단순 챗봇 실행을 넘어 자율적인 에이전트 구동 단계로 진입한다. 엔비디아가 1페타플롭 성능의 'RTX Spark' CPU를 공개하며 2000억 달러 규모의 CPU 시장에 도전한다. 마이크로소프트, 델, HP 등 주요 제조사가 올가을부

AI 코딩 어시스턴트가 정답을 즉시 제공하며 학습자의 사고 과정을 대체하는 문제가 늘고 있다. 스탠퍼드 대학교 CS336 과정은 AI가 구현 대신 설명과 피드백만 제공하는 엄격한 가이드라인을 설정했다. 구체적인 디버깅 유도 질문과 프로파일링 데이터 요

기상 예보는 슈퍼컴퓨터와 물리 모델이 지배하는 영역이었다. 스타트업 윈드본이 공개한 '웨더메시 6'는 유럽 중기예보센터(ECMWF)보다 더 잦고 정확한 예측을 제공한다. 자체 기상 풍선 400개에서 수집한 데이터를 모델에 직접 입력해 예측 정밀도를 높

물리 AI는 현실 세계를 이해하고 다음 상황을 예측해 행동을 생성해야 한다. 엔비디아가 추론, 세계 생성, 행동 생성을 하나로 통합한 코스모스 3를 오픈소스로 공개했다. MoT 아키텍처 기반의 8B, 32B 모델과 학습 레시피, 6종의 합성 데이터셋을

중국 AI 스타트업 MiniMax가 100만 토큰 컨텍스트를 지원하는 M3 모델을 출시했다. GPT-5.5와 Gemini 3.1 Pro의 성능을 일부 추월하며 운영 비용을 8~20% 수준으로 절감했다. 10일 이내에 가중치 공개(Open Weights

구글이 검색 결과 상단에 AI 생성 개요를 배치하는 AI 우선 체제로 전환했다. DuckDuckGo는 AI 답변과 채팅 프롬프트를 제거한 'noai' 전용 페이지를 기본 검색엔진으로 설정하는 확장 프로그램을 출시했다. 출시 후 No-AI 페이지 방문자

AI가 데이터 시각화 라이브러리인 Matplotlib의 잘못된 코드를 생성하며 개발 효율성에 혼선을 빚었습니다. 모델의 환각 현상이 실무 코드 작성에 미치는 영향과 검증의 중요성이 다시금 강조됩니다.

엔비디아가 노트북과 데스크톱 PC를 위한 범용 칩을 공개했습니다. 기존 GPU 중심의 하드웨어 구성을 넘어 PC 시스템의 핵심 연산 영역으로 진출합니다.

LLM 서비스 운영 시 가장 큰 고민은 예상치 못한 비용과 복잡한 디버깅이다. 오픈소스 플랫폼 Spanlens는 baseURL 변경만으로 비용 추적과 에이전트 경로 시각화를 제공한다. LangGraph 토폴로지 뷰와 Critical Path 분석으로

LLM의 생산성 폭발로 인간의 소비 속도가 개발의 새로운 병목이 됐다. 무분별한 AI 생성물인 '슬롭(Slop)'의 악순환을 막기 위해 자동 방어층 구축이 필수적이다. 이제 개발자의 핵심 역량은 단순 구현이 아니라 시스템 아키텍처 설계와 컨텍스트 관리

AI 모델 성능이 올라가며 단순한 앱 서비스들이 거대 랩에 흡수되고 있다. 하지만 복잡한 산업별 워크플로와 규제를 해결하는 버티컬 영역은 여전히 기회다. 모델은 교체 가능하지만 실제 업무가 돌아가는 시스템을 소유한 기업이 살아남는다.

플랫폼과 무관하게 적용 가능한 웹사이트 기술 표준인 'The Website Specification'이 공개되었습니다. SEO, 보안, 성능 등 10개 영역을 다루며 MCP 서버를 통해 AI 에이전트의 접근성을 높였습니다.

AI 구독 비용에 대한 부담과 효용성 고민이 제기되었습니다. 구독 해지를 통해 최적의 도구 조합을 찾는 움직임이 나타나고 있습니다.

ChatGPT와 Claude의 UI 경험을 개인 서버에서 구현하는 셀프 호스팅 워크스페이스 Odysseus 1.0이 공개됐다. ChromaDB, SearXNG, ntfy를 통합해 로컬 데이터 기반의 프라이버시 중심 환경을 제공한다. 셸 접근, 모델 다

AI 에이전트가 단순 대화를 넘어 실제 업무를 수행하는 실행 단계로 진입했다. StepFun이 공개한 Step 3.7 Flash는 초당 최대 400토큰의 처리량을 구현했다. 256k 컨텍스트 윈도우와 3단계 추론 설정을 통해 비용과 성능의 균형을 맞췄

이미지 생성 AI를 쓰려면 비싼 서버 비용과 대기 시간이 필수였다. PrismML이 모델 크기를 획기적으로 줄인 Bonsai Image 4B를 공개했다. 아이폰 17 프로 맥스에서 512px 이미지를 9.4초 만에 생성한다.

최신 GPU의 VRAM 부족 문제를 중고 데이터센터 GPU 조합으로 해결했다. Tesla V100 SXM2와 어댑터를 사용하여 총 32GB VRAM 환경을 구축했다. Qwen3.6-27B 모델을 초당 최대 60토큰 속도로 로컬에서 구동했다.

AI가 알려진 취약점 공격을 넘어 스스로 제로데이 취약점을 발견하는 단계에 진입했다. Claude Mythos는 CyberGym 83.1%를 기록하며 취약점 발견의 '안전 마진'을 제거했다. 기존 CVSS 중심의 패치 우선순위 체계는 AI의 공격 속도

AI와 인간의 능력 격차가 좁아지며 기존의 인간 가치 옹호 논리가 흔들리고 있다. 창작물의 질을 결정하는 '의도'와 '형식' 중 AI는 의도 없는 형식만 빠르게 생성한다. 결과물의 품질이라는 가변적 수치 대신 인간 존재 자체의 가치를 선언하는 논리가

LLM 외부 도구 연결 표준인 MCP가 과도한 토큰 소비와 성능 저하 문제를 드러냈다. 4개 서버 연결 시 컨텍스트의 최대 16.5%가 도구 정의로 낭비되며 호출 속도는 API 대비 3배 느리다. CLI 우선 전략과 필요할 때만 로드하는 '스킬(Ski

코딩 에이전트 사용 시 급증하는 세션 관리의 불편함이 실무적 병목이 된다. pisesh는 즐겨찾기와 검색 기능을 통해 pi의 세션 복구 과정을 효율화한다. npm 설치 후 pi 내부에서 /sesh 명령어로 즉시 호출해 사용할 수 있다.

AI로 인한 일자리 상실이 단순한 경제적 불안을 넘어 심리적 '애도' 단계로 진입했다. 2025년 플로리다대 연구진은 이를 'AI 대체 장애(AIRD)'라는 새로운 임상 개념으로 정의했다. 인지 노동자의 전문성이 곧 정체성인 특성상, 과거 산업혁명보다

AI 에이전트에게 프로덕션 권한을 줬을 때 발생하는 통제 불능 위험을 해결한다. 자격 증명을 분리 보관하고 SQL·k8s 등 와이어 레벨 트래픽을 파싱해 액션을 게이팅한다. LLM 판사와 사람의 승인 절차를 결합해 위험 호출을 실시간으로 차단하는 구조