태그: SSE
4편
-
WebSocket vs SSE vs 롱 폴링 | 실시간 통신 방식 비교
WebSocket, SSE, 롱 폴링을 통신 방향과 구현 복잡도, 프록시·방화벽 환경 기준으로 비교하고 Node.js 서버·클라이언트 코드로 구현해 봅니다. AI 응답 스트리밍에 SSE를 쓰는 예시, RFC 6455 업그레이드 핸드셰이크와 프레임 구조, Ping/Pong 하트비트도 다룹니다.
-
C++ SIMD 최적화: SSE·AVX2·AVX-512·NEON 인트린직, 자동 벡터화, C++26 std::simd
C++ SIMD를 SSE·AVX2·AVX-512·NEON 인트린직, 자동 벡터화, C++26 std::simd로 정리합니다. float 합산이 -O3에서도 벡터화되지 않는 이유(-ffast-math), 메모리 대역폭 한계, -march=native 배포 사고와 런타임 디스패치(target_clones, __builtin_cpu_supports)까지 다룹니다.
-
C++ SIMD 최적화: 자동 벡터화 조건, SSE·AVX 인트린식, 메모리 정렬
SIMD(단일 명령 다중 데이터)의 동작 원리부터 컴파일러 자동 벡터화, SSE·AVX 인트린식 사용법, 메모리 정렬과 루프 데이터 의존성 문제까지 실전 벡터 연산 최적화 기법을 코드와 함께 설명합니다.
-
루프가 병목일 때: 자동 벡터화, std::execution 병렬 정책, SSE·AVX2·AVX-512 인트린직
C++ SIMD와 병렬 알고리즘 정리. 루프 병목에서 출발해 std::execution 정책, 자동 벡터화 조건, SSE·AVX2·AVX-512 인트린직 사용법, 자주 나는 에러와 성능 벤치마크를 다룹니다.