AI 시대의 필수 소비재, 메모리 이해하기 4편: CXL 이해하기
CXL(Compute Express Link)의 등장 배경, CXL.io/.cache/.mem 세 가지 sub-protocol, Type 1/2/3 디바이스 분류, 1.1부터 3.x까지의 표준 진화, 그리고 삼성·SK하이닉스·마이크론의 CXL 메모리 제품군을 기술적으로 분석합니다.
기업 기술블로그의 AI/ML 관련 글 1219개
CXL(Compute Express Link)의 등장 배경, CXL.io/.cache/.mem 세 가지 sub-protocol, Type 1/2/3 디바이스 분류, 1.1부터 3.x까지의 표준 진화, 그리고 삼성·SK하이닉스·마이크론의 CXL 메모리 제품군을 기술적으로 분석합니다.
코드 품질만으로는 부족하다 — AI 코딩 에이전트가 이해하고 수정할 수 있는 코드베이스의 조건
도입 배경 소스 컴퓨트를 격리하면서 다른 계정이 Redshift로 쿼리하게 만들 수 있을까요? 한국 대형 리테일 그룹의 데이터 플랫폼 통합 프로젝트에서 맞닥뜨린 질문입니다. 자회사별로 Amazon Redshift와 ML 워크로드가 분리 운영되어 그룹 차원의 통합 분석과 AI/ML 활용에 사일로가 발생하던 환경이었고, SageMaker Unified Studio(이하 SMUS)로 그룹 단위 거버넌스를 통합해야 하지만, 동시에 각 자회사의 데이터
[ kt cloud DC동부운용팀 이민재 님 ] 요약 이 글에서는 AI 데이터센터 전력 케이블의 구조, 설계, 시공, 진단과 차세대 기술을 다룹니다. 안정적인 전력 공급이 인프라 신뢰도와 운영 관리에 미치는 영향을 정리합니다. #AI데이터센터 #전력케이블 #데이터센터인프라 #HVDC #XLPE 전력 확보 전쟁, 그 중심에 선 케이블 최근 '전력 확보 전쟁'이라는 말이 뉴스 헤드라인을 장식하고 있습니다. 생성형 AI의 등장으로 데이터센터의 랙당
RIMAN KOREA 소개 RIMAN KOREA는 2018년 설립된 K-뷰티 글로벌 다이렉트 셀링 기업입니다. 자이언트 병풀, 제주 용암해수 등 독자 원료를 기반으로 고기능성 스킨케어(ICD), 비건 뷰티(보타랩), 건강기능식품(라이프닝)을 주력 제품으로 합니다. 리만코리아의 E-Commerce 팀은 운영 중인 온라인 자사몰(이하 리만몰)을 고도화하기 위해 사용자로부터 접수된 문의 내역을 분석하였습니다. 그 결과 상품 검색이 어렵다는 문제를 발
챗GPT 등장 이후 미국에서만 60건이 넘는 AI 저작권 침해 소송이 제기되었습니다. 미국 외에도 캐나다, 영국, 네덜란드, 프랑스, 독일, 중국, 인도, 우리나라를 포함해 전 세계적으로 소송이 벌어지고 있습니다. 이 글에서는 미국의 주요 판례를 중심으로 AI 저작권 소송의 쟁점이 무엇인지, 그리고 법원이 이러한 사안을 어떤 기준으로 어떻게 판단하고 있는지 살펴봅니다. 이를 통해 현재 진행 중인 소송의 결과를 미리 예측해 볼 수 있고, 앞으로
"이거 돌아가?"라는 가장 비싼 질문을 자동화하고, Code Review를 동작 검증에서 설계 검증으로 전환하는 과정
최근 AI 개발의 흐름은 단순한 “질문과 답변”을 넘어, 스스로 작업을 계획하고 도구를 사용하며 결과물을 만들어내는 AI 에이전트(Agent) 중심으로 빠르게 이동하고 있습니다. 과거에는 “프롬프트를 어떻게 잘 쓰느냐”가 중요했다면, 이제는 “AI가 실제 업무 환경에서 얼마나 안정적으로 일하게 만들 수 있느냐”가 더 중요한 과제가 되고 있습니다. 아무리 성능이 뛰어난 LLM이라도, 어떤 파일을 읽어야 하는지, 어떤 도구를 사용해도 되는지, …
이 글은 Claude Code의 핵심 설정 파일인 CLAUDE.md를 효율적으로 관리하기 위한 컨텍스트 엔지니어링 전략을 다룹니다. 무분별한 규칙 추가가 오히려 AI의 성능을 저해하는 컨텍스트 부패(Context Rot) 현상을 설명하고, 이를 방지하기 위한 JIT(Just-In-Time) 전략, 메모리 계층 구조 활용, 그리고 안드레 카파시(Andrej Karpathy) 스타일의 간결한 지침 작성법을 제시합니다. 단순한 프롬프트 작성을 넘어
매년 봄과 가을, 네이버 엔지니어들은 Engineering Day를 통해 서로의 기술과 경험을 나눕니다. 한해동안 200개가 넘는 기술 세션이 공유되며, 실무 개발 경험과 신기술 도입시 유용하게 활용될 수 있는 팁을 교환하고 함께 성장하는 자리로 이어져 왔습니다. 올해는 '모두의' Engineering Day! 그동안 Engineering Day가 주로 개발 직군 간의 교류를 중심으로 진행됐다면, 올해는 AI 도구의 발달과 함께 전 직군이 더
HBF에게 적합한 자리는 분명히 있습니다. 하지만 memory hierarchy 피라미드에 들어가기 위해서는 아직 부족한 점이 많습니다. 최신 LLM 모델 및 추론 워크로드 트렌드, 그리고 Flash memory의 LLM 사용 방식을 살펴보며 HBF의 남은 과제와 극복 방안에 대해 살펴봅니다.
대규모 분산 훈련에서 GPU 간 통신 성능은 전체 훈련 효율을 좌우하는 핵심 요소입니다. 수백 대의 GPU가 그래디언트(gradient, 모델이 실수를 고치는 방향 지시서)를 주고받아야 하는 환경에서, 데이터가 GPU 메모리에서 네트워크를 거쳐 원격 노드의 GPU 메모리에 도달하기까지의 경로를 얼마나 효율적으로 설계하느냐가 곧 성능의 차이로 이어집니다. 이번 블로그는 이 시리즈의 마지막 편으로, AWS 인스턴스에서 활용되는 GPU 간 고속 […
더 많은 음악이 팬을 만나고, 더 큰 무대로 이어져 성장할 수 있도록 음악 IP의 생애주기를 설계하고 성장시키는 드림어스컴퍼니의 IP 풀 밸류체인(Full Value-Chain)을 직접 만드는 팀과 사람들을 소개합니다. 두 번째 Team Spotlight의 주인공은 FLO Web Frontend 개발자이자, 드림어스컴퍼니의 AX(AI Transformation)를 현장에서 이끌고 있는 Claud(박예림)입니다. 'FLO Vibe
정확하게 답하는 능력만큼 중요한, 답하지 않을 줄 아는 능력 이 글은 사내 본부 세미나에서 다룬 두 편의 논문 — AbstentionBench(Kirichenko et al., FAIR at Meta, arXiv:2...
최근 많은 기업들이 자체 LLM을 구축하거나, 오픈소스 sLLM(Small Large Language Model)을 활용하여 설치형 LLM서비스를 구성하려는 수요가 크게 증가하고 있습니다. 그런데 실제로 배포하려는 모델을 살펴보면, Llama 3 70B, Qwen 72B, EXAONE 3.5 32B 등 모델을 GPU에 로드할 때 필요한 메모리가 40GB에서 최대 150GB에 달하는 경우가 많아, GPU 메모리가 80GB인 H100/H200이 탑
시리즈 안내 이 글은 3편으로 기획된 GraphRAG Toolkit 시리즈의 3번째 글입니다. 시리즈의 첫 번째 글인 Neptune GraphRAG Toolkit을 활용하여 정교한 비정형 데이터 검색하기에서는 비정형 데이터에서 벡터 임베딩이 포함된 그래프를 자동으로 구축하고, 구조적으로 관련된 정보를 검색하는 질의응답 전략 프레임워크를 소개했습니다. 두 번째 글인 GraphRAG Toolkit으로 지식 그래프 인덱싱하기에서는 해당 toolkit
페이지 23 / 68 (총 1219개)