어느정도까지 내가 올바르게 설명을 할 수 있을지 모르겠다 :( 정말 어렵다 ㅠㅜ 대학교때 배웠던 교재랑 ppt를 탈탈털어서 공부를 했는데 많이 부족함을 느낀다. 사실 프로토콜 읽거나 논문을 아~주 간단하게 유의하다/아니다 정도만 볼거라면 이정도로 충분하다 생각하지만.. 공부해야 하는 내용이 있다면 내용을 추가하는 것으로하고 통계학과 졸업생이 아닌 나로서는 이번 공부는 여기서 마무리지으려 한다. 고생많았다 내자신 ㅎㅎ.. PART. 2 통계 분류 2. 통계 분석 방법 심화 1) 비교집단간 차이를 비교 ① 평균분석 - 비교 해야 할 집단이 두 개만 존재할 때 -> 두 개 집단의 평균 등을 비교 A. Z-test: 모집단의 분산을 미리 알고 있는 경우나 표본의 크기가 30개 이상일 때 사용하는 방법 Ø 분산을..
이번에는 실제로 SPSS라는 통계프로그램에도 사용되고, 논문을 읽을 때도 간단하게 알면 좋은? 본격적인 통계에 대해 정리해보려고 한다! 생각보다 어렵고 또 처음에 틀을 잘 잡아야 하는데 통계분석 종류가 너어어어어어무 많아서 어디까지가 알면 좋은 내용일지.. 어떻게 분류할지 엄청 고민했다 ㅎㅎ.. PART. 2 통계 분류 1. 통계 분석 방법 분류 기초 1) 정규분포 # 정규분포는 제품 무게, 사람의 키 등 여러 자연적인 현상을 설명하고자 할 때 잘 적합 되기에 널리 사용되고 있다. 왜냐면 일반적으로 자연상태에서 데이터를 수집하면 그림과 같이 데이터는 중앙이 되는 값(평균)에 몰리고 중앙에서 멀어질수록 그 수가 줄어드는 분포를 띠기 때문이다. # 정규분포는 국어사전에서 다음과 같이 정의됩니다. 2) 모수와..
일단 통계의 기초는 이번까지해서 마무리하고 이후부터는 통계의 종류? 그리고 정~~~말 간단히논문 통계를 읽는 법을 공부해보려고 한다 PART. 1 통계의 용어 정리 4. 연구의 종류 9) 역학연구 개념 # 역학적 연관성: 인간집단의 건강과 관련된 여러 현상이 어떤 요인과 관련 있는지 확인하기 위한 과정 # 역학 연구 설계 방법: 기술역학, 분석역학, 실험역학, 이론역학 # 발생률/유병률/치명률이라는 개념부터 잡고가볼까유 ① 발생률: 일정기간 동안 한 인구 집단에 새로 발생한 환자 수 연구결과의 모집단 적용 가능 - 시점 조사라서 시간/경비 절약 - 대상 질환의 유병률 구할 수 있음 - 원인과 결과 중 어떤 것이 선행되는지 확정 어려움 # 예시 Ø Ex. 현재는 건강한데 흡연 OX여부에 따라 일정시간 경과..
이번에는 대학교때 배웠던 통계내용을 탈탈 털어왔다 지역사회간호까지 다시보면서 복습하는 행복한(?) 시간을 가졌다 PART. 1 통계의 용어 정리 3. 가설과 비 5) 신뢰구간, 귀무가설, 대립가설, 1종오류, 2종오류 ① 신뢰구간(Confidence Interval; CI): 신뢰구간은 모수가 실제로 포함될 것으로 예측되는 범위 - Ex. 내가 모집단에서 다음과 같이 표본을 뽑아서 측정을 했는데, 과연 이 표본이 얼마나 모집단을 잘 대표할지~ 내가 이 표본 결과를 신뢰할 수 있을지(신뢰수준이 얼마나 되는지)를 보는 것! - 신뢰수준(Confidence Level): 신뢰구간에 모집단 실제 평균값이 포함될 확률 - 일반적으로 95% 또는 99% 사용 (뒤에 나오는 유의수준 0.05의 기준) - 표본이 많을..
이번에는 중~고등학교때 배웠던 통계내용을 탈탈 털어왔다 적당히 공부해야지라고 생각해도 하다보면 자꾸 많아지네 PART. 1 통계의 용어 정리 2. 값과 표본 1) 대푯값과 산포도 ① 대푯값: 모아진 자료의 특성을 설명, 관찰된 자료가 어떤 위치에 치중되어 있는지를 나타낸 값 A. 평균(Mean): 모든 관측값의 합을 자료의 개수로 나눈 것 (관측값들의 무게중심) Ø Ex. 2,6, 10의 평균 à (2+6+10)/3개 = 6 Ø 극단적으로 큰 값이나 작은 값의 영향을 많이 받음 ex. 2,3, 100의 평균을 구하면 값이 확 올라서 35가 됨 B. 중앙값(Median): 전체 관측값을 정렬했을 때 가운데에 위치하는 값 Ø 자료의 개수(n)가 홀수인 경우: (n+1)/2번째 관측값 Ø 자료의 개수(n)가 ..
첫번째는 변수에 대한 개념부터 잡고가야겠다고 생각했다. 독립변수도 변수.. 명목변수도 변수 변수를 치면 너무 다양한(?) 개념이 나와서 정리가 초큼 어려웠따 PART. 1 통계의 용어 정리 1. 변수 1) 변수 # 통계가 왜 필요한가? 내가 증명하고 싶은 것(가설) 세우고 그 가설이 맞다는 것을 검증하는데 있어서 필요하다. # 그럼 변수랑 가설은 무슨 관계인가? 변수를 설정하고, 변수 간의 인과관계가 가설에서 설정한대로 나타나는지 확인한다. # 변수에 대해 네이버 국어사전은 다음과 같이 정의하고 있다. # 변수의 종류(12번만이라도 알아두자) ① 독립변수(independent variable) - 인과관계에서 다른 변수의 변화를 일으키는 변수, 원인(cause)을 의미하고, 함수에서는 X값, 실험 설계에..
프로토콜을 읽다보면 중간중간 통계에 대한 지식이 필요할 때가 있다. 물론 konet 강의에서 일부를 설명해주기도 하지만, 프로토콜을 숙지하기에는 부족하다고 느꼈고 중학교~대학교까지 조금씩 배우긴 했지만 중학교때 배운 개념은 하나도 머리에 남아있지가 않기에 ㅎㅎㅎ 공부를 어떻게 해나갈까 고민을 했다. 한가지 책을 기준으로 잡고 그 책의 목차에 있는 내용을 정리하는 것도 괜찮겠다는 생각이 들어서 시작해본다! :) 참고한 목차의 책은 이다. 목차만 참고해서 공부하고.. 중간중간 더 필요한 공부가 있겠다 싶으면 목차를 조금 수정했다 ㅎㅎ(책 비싸.....ㅠ) http://www.yes24.com/Product/Goods/91003947 의학통계 배우기 - YES24 의학통계 배우기 www.yes24.com 예전..
개요 요즘에는 이미지에서 사물을 찾는 객체 탐지 기술들이 많이 발전했고, 일상 생활에서도 흔히 볼 수 있습니다. 그 중에서, 딥러닝(CNN)을 사용하여 객체들을 찾는 최초 시도를 했던 RCNN 논문에 대해 알아보겠습니다. 해당 논문은 Rich feature hierarchies for accurate object detection and semantic segmentation라는 이름으로 2014년 CVPR에 게재되었습니다. 기존에는 sliding window 방식으로 모든 영역을 탐색하며 물체를 검출했는데, 이 방식은 많은 비용을 요구했습니다. 이를 해결하기 위해 CNN을 사용했고, 비용 절감과 성능 향상을 이뤄냈습니다. 구조 RCNN의 전체 구조는 아래 그림들과 같이 표현될 수 있습니다. Region..
원인을 알 수 없는 소화장애 요즘 알 수 없는 어지럼증, 그리고 근육결림에 시달려서 다양한 원인을 찾아보게 되었다. 그러다가 발견한 자가진단이 있었다. 상기증상 중 반 이상이 해당된다면, 담적병으로 진단할 수 있으며, 치료가 필요합니다. 담적병이 뭐지???? 뭔데 나는 절반 넘게 해당이 되는걸까??? 담적(痰積): 담이 쌓여있는 상태 담: 체내를 순환하는 액체가 비정상적으로 일정 부위에 몰려서 딱딱하게 굳어진 것(노폐물이 굳은 것) 식적: 담적이 만성적으로 쌓여 굳어진 상 원인 -잘못된 식습관, 생활습관 -스트레스 -흡연, 음주 등 한 마디로 몸이 지치거나 안좋은 습관을 통해 안좋아져서 대사가 떨어져 노폐물이 배출안되고 쌓여서 독소가 나오는것..! 주요 증상은 -상부 위장관 질환: 속쓰림, 속메스꺼움, ..
개요 결정 트리는 주어진 데이터에서 문제를 더 잘 해결하기 위해, 더 많은 조건을 줄 수 있습니다. 그 경우, 주어진 데이터의 문제는 완벽히 해결할 수 있지만, 새로운 데이터가 들어왔을 때에는 문제를 해결하지 못할 수 있습니다. 이렇게 특정 데이터 셋에 너무 최적화되어 새로운 데이터 셋에 적용하지 못하는 경우를 과적합(overfitting)이라고 합니다. 결정 트리의 과적합 문제를 막기 위해서, 랜덤 포레스트는 전체 데이터 중 랜덤으로 선택된 일부 데이터에 과적합된 결정 트리를 많이 만들고, 만들어진 결정 트리의 결과를 평균냄으로써 과적합을 해결하고 성능을 향상시킵니다. 동작 과정 Step 1 각 결정 트리는 전체 데이터의 부분 데이터 셋에 대해 과적합이 되어야 합니다. 이를 위해서 부트스트랩 샘플(bo..