태그: SIMD
4편
-
C++ SIMD 최적화: SSE·AVX2·AVX-512·NEON 인트린직, 자동 벡터화, C++26 std::simd
C++ SIMD를 SSE·AVX2·AVX-512·NEON 인트린직, 자동 벡터화, C++26 std::simd로 정리합니다. float 합산이 -O3에서도 벡터화되지 않는 이유(-ffast-math), 메모리 대역폭 한계, -march=native 배포 사고와 런타임 디스패치(target_clones, __builtin_cpu_supports)까지 다룹니다.
-
C++ 대용량 이미지 처리: OpenCV Mat 참조 카운팅, 필터·변환, SIMD, 멀티스레드 파이프라인
썸네일을 만들다 메모리가 터지거나 회전 후 이미지가 잘리는 문제를 OpenCV로 해결하는 방법을 다룹니다. cv::Mat 참조 카운팅과 스트리밍 로드, 블러·샤프닝·Canny 필터, 리사이즈와 회전, 색공간과 EXIF 방향 처리, SIMD·멀티스레드 파이프라인을 설명합니다.
-
C++ SIMD 최적화: 자동 벡터화 조건, SSE·AVX 인트린식, 메모리 정렬
SIMD(단일 명령 다중 데이터)의 동작 원리부터 컴파일러 자동 벡터화, SSE·AVX 인트린식 사용법, 메모리 정렬과 루프 데이터 의존성 문제까지 실전 벡터 연산 최적화 기법을 코드와 함께 설명합니다.
-
루프가 병목일 때: 자동 벡터화, std::execution 병렬 정책, SSE·AVX2·AVX-512 인트린직
C++ SIMD와 병렬 알고리즘 정리. 루프 병목에서 출발해 std::execution 정책, 자동 벡터화 조건, SSE·AVX2·AVX-512 인트린직 사용법, 자주 나는 에러와 성능 벤치마크를 다룹니다.