AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

OpenAI가 개인정보 탐지 및 마스킹 모델 Privacy Filter를 공개했다. 모델은 1.5B 파라미터로 로컬 실행이 가능하며 96% F1 점수를 기록했다. 기존 정규식 기반 도구 대비 문맥을 이해해 더 정교한 필터링이 가능하다.

양자 머신러닝은 양자 컴퓨팅과 머신러닝의 아이디어를 결합한다. 5개의 GitHub 리포지토리가 양자 머신러닝 학습에 유용하다. 각 리포지토리는 다양한 학습 스타일에 맞춘 자료를 제공한다.

NVIDIA가 기후 예측 AI 스택인 Earth-2를 공개했다. 데이터 전처리 연산량을 줄여 단일 GPU 구동을 구현했다. 초단기 기상 예측의 해상도를 킬로미터 단위로 정밀화했다.

Google DeepMind가 5대 글로벌 컨설팅사와 파트너십을 맺었다. 전 세계 기업의 AI 생산 단계 도입률을 25%에서 끌어올릴 계획이다. 단순 챗봇을 넘어 스스로 과업을 수행하는 에이전트 AI 보급에 집중한다.

Google이 AI 에이전트 시대를 위한 TPU 8i와 8t 칩을 공개했다. TPU 8i는 에이전트의 다단계 워크플로우 실행 속도를 높이는 데 최적화되었다. TPU 8t는 거대 모델을 단일 메모리 풀에서 학습시킬 수 있도록 설계되었다.

구글 클라우드가 엔비디아 루빈 GPU 기반 A5X 인스턴스를 발표했다. 이전 세대 대비 추론 비용은 10분의 1, 처리량은 10배 향상됐다. 보안 GPU 가상머신과 제미나이 온프레미스 배포도 함께 공개됐다.

Hyatt가 전 세계 직원에 ChatGPT Enterprise를 배치했다. Hyatt가 OpenAI와 함께 라이브 온보딩·교육을 진행했다. OpenAI는 전 세계 100만+ 비즈니스 고객이 사용 중이라고 밝혔다.

뉴질랜드가 GPT-5.1 기반의 지질 데이터베이스 NZGD를 구축했다. 자연어 쿼리를 통해 데이터 검색 시간을 기존 대비 40% 단축했다. AI가 분석이 아닌 데이터 필터링에 집중하도록 가드레일을 설정했다.

OpenAI가 기업용 도입을 돕는 Codex Labs를 출시했다. 400만 명의 개발자가 사용하며 7개 글로벌 시스템 통합 기업과 협력한다. 단순 코딩을 넘어 브라우저 작업과 문서 작성 등 업무 전반으로 확장한다.

Photon이 AI 에이전트 배포 프레임워크 Spectrum을 공개했다. iMessage와 왓츠앱 등 기존 메시징 앱에 에이전트를 직접 연결한다. 엣지 네트워크를 통해 150~250ms의 초저지연 응답 속도를 구현했다.

Hyperopt와 TPE 알고리즘을 활용한 하이퍼파라미터 최적화 파이프라인을 구현했다. 모델 선택과 파라미터 튜닝을 동시에 수행하는 조건부 탐색 공간을 구축했다. 조기 종료 기능과 결과 분석 도구를 통해 최적화 효율을 높였다.

DVC와 SageMaker AI MLflow를 결합해 모델 학습 데이터의 계보를 완벽히 추적한다. 데이터 버전 관리와 모델 수명 주기 관리를 분리하여 감사 요구사항을 충족한다. Git 커밋 해시를 매개변수로 기록하여 학습 데이터와 모델을 정밀하게 연결

Anthropic이 Claude Cowork를 Amazon Bedrock에서 실행하는 기능을 발표했다. 기업은 AWS 환경 내에서 데이터 보안을 유지하며 지식 노동자에게 AI를 배포할 수 있다. 기존 AWS 청구 체계를 활용하며 별도의 좌석 라이선스

AI 생성 이미지 기술이 성적 착취물과 정치적 선동에 악용되고 있다. Grok의 이미지 편집 기능이 성적 이미지 생성에 활용되는 등 부작용이 크다. 기술적 방어와 법적 규제만으로는 악의적인 딥페이크 확산을 막기 어렵다.

AI 도구가 사이버 범죄자들에게 새로운 기회를 제공하고 있다. 범죄자들이 AI를 활용해 피싱 이메일과 딥페이크 영상을 제작하고 있다. 사이버 공격의 양과 질이 증가하면서 방어의 중요성이 더욱 커지고 있다.

LLM이 복잡한 문제를 스스로 해결하는 LLM+ 단계로 진화하고 있다. 트랜스포머 구조를 벗어나 확산 모델과 재귀적 처리 방식을 도입한다. 컨텍스트 윈도우 확장과 효율적 연산으로 자율적 업무 수행을 목표로 한다.

휴머노이드 로봇 학습을 위해 인간의 동작 영상 데이터 수집이 가속화되고 있다. 중국 AI 연구소들이 최첨단 모델을 무료로 배포하며 글로벌 영향력을 확대하고 있다. 단일 AI 에이전트에서 협력형 멀티 에이전트 체계로 기술 패러다임이 전환 중이다.

OpenCode, Ollama, Qwen3-Coder를 결합해 오프라인 AI 코딩 도우미를 구축할 수 있다. 이 설정은 개인 정보 보호와 비용 절감의 장점을 제공한다. 설치 과정과 사용법을 통해 개발자들이 효율성을 높일 수 있다.

구글과 EPFL 연구팀이 합성 데이터 생성 프레임워크 '시뮬라'를 발표했다. 시뮬라는 계층적 분류체계와 이중 비평 구조로 데이터 품질·다양성·복잡성을 동시에 제어한다. 사이버보안·법률·수학 등 전문 영역에서 최대 51만2000개 데이터 포인트를 생성할

iterrows() 대신 벡터화 조건문으로 50~100배 속도 향상이 가능하다. merge() 검증 없이 조인하면 데이터가 조용히 수백만 행으로 부풀어 오른다. transform()과 pipe()로 그룹 연산과 체인을 한 단계로 압축한다.

개발자들이 도커 이미지 크기 문제로 어려움을 겪고 있다. 최적화 기법을 적용하면 이미지 크기를 60~80% 줄일 수 있다. 이 기법들은 도커 사용자의 빌드 시간을 단축시키는 데 도움을 준다.

아랍어 LLM 평가를 위한 새로운 리더보드 QIMMA가 공개되었다. 기존 벤치마크의 품질 문제를 해결하기 위해 다단계 검증을 도입했다. 검증 결과 Jais-2-70B-Chat 모델이 종합 성능 1위를 차지했다.

Moonshot AI가 Kimi K2.6 모델을 오픈소스로 공개했다. 모델은 300개 하위 에이전트와 4,000개 협력 단계를 지원한다. SWE-Bench Pro에서 58.6점을 기록하며 GPT-5.4를 앞질렀다.

Microsoft의 Phi-4-mini 모델이 4비트 양자화로 제공된다. 개발자는 이를 통해 대화형 AI와 도구 호출을 구현할 수 있다. LoRA를 활용한 경량화된 맞춤형 학습이 가능해졌다.

Nemotron-Personas-Korea가 600만 개 합성 페르소나를 제공한다. KOSIS·대법원·건보공단·농촌경제연구원 통계로 인구 분포를 고정한다. PII 없이 PIPA를 고려해 페르소나를 시스템 프롬프트로 주입한다.

연구팀이 비전-언어 모델의 내부 표현에서 불필요한 정보가 유출될 위험을 체계적으로 비교했다. 모델의 최종 로짓만으로도 이미지의 작업과 무관한 세부 정보를 상당 부분 복원할 수 있었다. 튜닝 렌즈로 얻은 저차원 투영과 로짓 기반 정보량이 거의 동등한 수

Google이 크롬 브라우저 우측 상단에 제미나이 아이콘을 추가했다. 열려 있는 여러 탭의 정보를 한 번에 비교하고 정리할 수 있다. 기기 내부에서 작동하는 제미나이 나노 모델로 이미지 변환 기능도 제공한다.

구글이 AI 제미나이를 크롬에 통합했다. 이제 복잡한 작업을 쉽게 처리할 수 있는 기능이 추가되었다. 브라우저에서 멀티태스킹과 정보 검색이 한층 수월해졌다.

Amazon SageMaker AI에서 G7e 인스턴스가 출시됐다. NVIDIA RTX PRO 6000 GPU를 활용해 성능이 2.3배 향상됐다. 비용은 G6e 대비 2.6배 절감 가능하다.

Amazon Bedrock AgentCore로 음성 주문 에이전트를 배포했음. Amazon Nova 2 Sonic을 Bedrock에서 speech-to-speech로 썼음. Amplify·API Gateway·DynamoDB로 옴니채널 주문 흐름을 연