라인
2026-06-23 · 약 1개월 전
프롬프트 튜닝을 수작업에서 AI 튜닝으로: 유전 알고리즘 기반 자동 최적화와 고속화
LY Corporation의 기술 컨퍼런스인 Tech-Verse 2026의 공식 기사입니다.안녕하세요. LY Corporation의 Nakano입니다. Yahoo! JAPAN Se...
기업 기술블로그의 Performance 관련 글 467개
라인
2026-06-23 · 약 1개월 전
LY Corporation의 기술 컨퍼런스인 Tech-Verse 2026의 공식 기사입니다.안녕하세요. LY Corporation의 Nakano입니다. Yahoo! JAPAN Se...
네이버 클라우드 플랫폼
2026-06-16 · 약 1개월 전
네이버클라우드가 지난 5월 열린 세계 최대 해킹·보안 컨퍼런스 데프콘(DEF CON)의 해킹대회 CTF 2026 예선에서 686개 팀 중 7위를 기록하며, 오는 8월 미국 라스베이거스에서 열리는 본선 진출을 확정했습니다! 데프콘 CTF는 전 세계 최정상급 화이트해커와 보안 전문가들이 참가하는 해킹 대회로, 업계에서는 흔히 '해킹 올림픽'이라고 불리는데요. 특히 본선 무대는 단 12개 팀에게만 주어지는 만큼, 이번 성과는 더욱 의미가 깊습니다.
밸런스히어로
2026-06-15 · 약 1개월 전
Iceberg의 강력한 기능은 공짜가 아니다 — 6개월간의 운영에서 배운 것들
크리에이트립
2026-06-15 · 약 1개월 전
네이버
2026-06-12 · 약 1개월 전
"조직이 잘하고 있는지 어떻게 알 수 있을까?" 이 질문에서 출발해 사내 가이드 문서와 AI를 붙들고 직접 측정 도구를 완성하기까지 9일이 걸렸습니다. 그 과정을 기록으로 남깁니다. 사내 생산성 측정에 관한 고민 기술 PM으로 일하면서 조직과 프로젝트의 생산성을 어떻게 측정할지는 늘 풀리지 않는 과제였습니다. 스프린트를 원활하게 진행하는 것 같아도 막상 이를 수치로 보여달라고 하면 난감했습니다. 속도가 빨라지는지, 병목이 어디서 발생하는지, 지
Google for Developers
2026-06-12 · 약 1개월 전
개발자 여러분, 안녕하세요!6월 둘째 주 블로그에 발표된 Google의 주요 개발자 제품별 최신 소식을 살펴보세요.[주요 개발자 블로그 업데이트]AI & Machine Learning‘Gemini 3.5 라이브 번역’을 통한 매끄럽고 자연스러운 음성 번역 (국문) 개발자를 위한 DiffusionGemma 핵심 가이드 (DiffusionGemma: The Developer Guide) 2026년 5월에 발표된 최신 AI 소식 총정리 (The la
삼쩜삼
2026-06-10 · 약 1개월 전
이용자 평균 이틀에 한 번 접속하는 일상 앱 안착…누적 적립 155억 포인트 상위 10% 이용자 월평균 1만1000 포인트 적립…편의점
카카오뱅크
2026-06-09 · 약 2개월 전
카카오뱅크는 날로 지능화되는 보이스피싱에 대응하기 위해 기존의 단일 거래(point) 기반 탐지 방식에서 벗어나, 고객의 연속된 행동을 분석하는 시퀀스 기반 탐지 모델을 개발했습니다. 이미지 분류에 사용되던 Vision Transformer(ViT) 아키텍처를 금융 시계열 데이터에 맞게 변형하여 고객의 앱 활동 및 거래 내역 시퀀스를 학습하고, 실시간 서빙 환경을 구축했습니다. 그 결과, 하루 평균 1,800만 건 이상의 추론 요청을 평균 20
네이버
2026-06-08 · 약 2개월 전
네이버 사내 기술 교류 행사인 NAVER Engineering Day 2026(5월)에서 발표되었던 세션을 공개합니다. 발표 내용 Karpathy의 AutoResearch 방법론을 라이브 스트리밍에 적용하여, AI 에이전트가 코드를 자율적으로 수정·빌드·실험·판정하는 루프를 구축하고 스트리밍 품질(QoE)을 17% 개선한 사례를 소개합니다. 발표 대상 스트리밍/플레이어 개발에 관심 있는 엔지니어 AI 에이전트를 실무 코드 최적화에 활용하고 싶은
KT 클라우드
2026-06-04 · 약 2개월 전
[ kt cloud Foundation플랫폼팀 서준호 님 ] 요약 이 글에서는 Kubernetes 기반 Fault-Tolerant GPU 클러스터의 안정적 운영과 유지 관리 방안을 다룹니다. 대규모 AI 인프라에서 장애 대응과 성능 저하 예방이 운영 신뢰성에 미치는 의미를 정리합니다. #Kubernetes #GPU클러스터 #FaultTolerance #Slurm #InfiniBand 생성형 AI와 대규모 언어 모델(LLM) 시대에 고성능 연산에
KT 클라우드
2026-06-01 · 약 2개월 전
[ kt cloud DC동부운용팀 이민재 님 ] 요약 이 글에서는 AI 데이터센터 전력 케이블의 구조, 설계, 시공, 진단과 차세대 기술을 다룹니다. 안정적인 전력 공급이 인프라 신뢰도와 운영 관리에 미치는 영향을 정리합니다. #AI데이터센터 #전력케이블 #데이터센터인프라 #HVDC #XLPE 전력 확보 전쟁, 그 중심에 선 케이블 최근 '전력 확보 전쟁'이라는 말이 뉴스 헤드라인을 장식하고 있습니다. 생성형 AI의 등장으로 데이터센터의 랙당
한글과컴퓨터
2026-05-29 · 약 2개월 전
이 글은 Claude Code의 핵심 설정 파일인 CLAUDE.md를 효율적으로 관리하기 위한 컨텍스트 엔지니어링 전략을 다룹니다. 무분별한 규칙 추가가 오히려 AI의 성능을 저해하는 컨텍스트 부패(Context Rot) 현상을 설명하고, 이를 방지하기 위한 JIT(Just-In-Time) 전략, 메모리 계층 구조 활용, 그리고 안드레 카파시(Andrej Karpathy) 스타일의 간결한 지침 작성법을 제시합니다. 단순한 프롬프트 작성을 넘어
하이퍼엑셀
2026-05-28 · 약 2개월 전
HBF에게 적합한 자리는 분명히 있습니다. 하지만 memory hierarchy 피라미드에 들어가기 위해서는 아직 부족한 점이 많습니다. 최신 LLM 모델 및 추론 워크로드 트렌드, 그리고 Flash memory의 LLM 사용 방식을 살펴보며 HBF의 남은 과제와 극복 방안에 대해 살펴봅니다.
딜라이트룸
2026-05-27 · 약 2개월 전
TVING
2026-05-26 · 약 2개월 전
데보션
2026-05-26 · 약 2개월 전
Dag 파싱을 최적화 한다는 것? 저만 그런진 모르겠지만 저는 처음에 Dag 가 파싱되는 것을 최적화 한다는 것이 어떤 것인지 이해가 어려웠습니다. 그래서 거기서 부터 설명을 하면 좋을 것 같아서 끄적여보았습니다. ...
AWS
2026-05-22 · 2개월 전
이 글은 현대오토에버의 GenAI Sandbox 활용 생산성 향상 해커톤 시리즈의 두 번째 글이며, 현대오토에버의 김만철, 최라윤님과 함께 작성하였습니다. 첫 번째 글에서는 현대오토에버와 AWS가 GenAI Sandbox를 활용해 어떻게 생산성 향상 해커톤을 기획하고 운영했는지, 그리고 14개 팀 150여 명이 참여한 이 행사의 전반적인 성과를 소개했습니다. 이번 글에서는 해커톤 수상 팀 중 하나인 ErrorWatcher 팀이 AWS에서 Lan
TVING
2026-05-21 · 2개월 전
페이지 3 / 26 (총 467개)