전체 글 (43) 썸네일형 리스트형 돈만주면 모델들 다 써먹을 수 있는 사이트 - huggingface https://huggingface.co/CompVis/stable-diffusion-v1-4?text=a+cute+mini+octopus+preparing+trip+all+over+the+world CompVis/stable-diffusion-v1-4 · Hugging Face Misuse, Malicious Use, and Out-of-Scope Use huggingface.co 천재들이 많은 지구. 많은 ai개발자가 만든 모델을 쉽게쉽게 쓸 수 있는 시대가 왔습니다. 위 사이트에서 Multimodel부터 Computer Vision, NLP, 음성 등 여러 모델을 가져다 쓸 수 있는데 API 사용은 유료가 대부분이에요 ㅠ 내 돈주고 하긴 아깝지만 회사에서 사도 된다고 하면 아주 꿀일듯합니다. 전 그.. Chat GPT가 내가 원하는 데이터로 완벽한 ML을 하게 해줄까? 도전글 안녕하세요 요즘 오만군데에서 다 사용되고, 극찬을 받는 Chat GPT. https://github.com/travistangvh/ChatGPT-Data-Science-Prompts GitHub - travistangvh/ChatGPT-Data-Science-Prompts: A repository of 60 useful data science prompts for ChatGPT A repository of 60 useful data science prompts for ChatGPT - GitHub - travistangvh/ChatGPT-Data-Science-Prompts: A repository of 60 useful data science prompts for ChatGPT github.com 똑똑.. [통계학입문] 모분산 추정하기 - 카이제곱분포 이용 (1) 모분산 알고있을 때 모평균 추정 : 표본평균을 이용해서 추정 (2) 모평균을 알고있을 때 모분산 추정 : 어떻게? (3) 모평균을 모를때 모분산 추정 : 어떻게? (4) 모분산을 모를때 모평균 추정 : 어떻게? 이번글은 (2)번에 대한 글입니다! 책의 2부 초반은 "표본평균"으로 "모평균"을 구하는 방법을 알려주었다. 하지만 책통계를 다루는 사람들은 이미 알고있듯, "평균값"이라는 통계량 하나로 모집단의 분포를 제대로 알 수 없다. 제대로 알기위해선, 모평균의 짝궁인 "표준편차" 혹은 "모분산"을 알아야한다. 그럼 정규모집단인 상황에서, 몇개의 관측 데이터의 평균과 편차를 가지고 모분산을 알 수 있을까? 관측된 n개의 데이터들의 표준편차들은 어떤 성질을 가질까? 1. 표본분산을 구하는 방법 모집단.. [통계학입문]표본평균을 이용해 모평균 추정하는 방법 모분산을 알고 있는 정규모집단의 모평균은? ? 🔹문제🔹 편의점에서 판매하는 삼각김밥을 자동으로 만드는 기계가 있다. 이 기계는 무게를 다양하게 조절할 수 있으나 오차가 발생한다.완성된 삼각김밥 무게의 모든 데이터를 모집단이라고 할때, 그것은 정규모집단이고, 모표준편차가 10그램이다. 25개의 삼김을 만들었더니, 그 표본평균은 80그램이였다. 제조된 삼각김밥의 무게 모평균을 95% 신뢰구간에서 구간추정을 해보시오. (1) 알고있는 부분 정리 - 모집단은 정규분포 → 표본평균도 정규분포 형태 - 모표준편차(σ) = 10g - N = 25 - 표본평균(X바) = 80g - 표본평균 분포의 평균값 = 모평균(μ) - 표본의 표본오차 = σ/루트 N = 10/5 = 2 (2) 식 -1.96 [통계학입문] 표본평균의 중요성 ✔ 모집단에서 충분할 정도로 많이 반복해 데이터 관측을 한 후 히스토그램을 작성하면, 그 히스토그램은 모집단과 일치한다 (= '랜덤 샘플링 가정') ✔ 즉, 관측을 미친듯이 하면 모집단의 모습을 선명하게 파악 가능하다 우리의 목표 : 적은 관측으로 최대한 모집단 모습을 추측하는 것 우린 모평균값을 알면, 모집단의 데이터는 대략 모평균 주변에 분포하는 사실을 알 수 있다. ✅ μ('뮤') = 모집단의 평균값 = "모평균" 하지만 모평균값을 알기는 어렵지. 왜? 모집단의 모든 수치를 아는 경우가 적으니까! 🤷🏻♀️ 그럼 우린 뭘해야할까? 🙋🏻♀️ 관측 데이터로 모평균을 파악해야지! Q. 모평균만 가지고 모집단의 분포의 모습을 잘 파악했다고 볼 수 있나? A. 아니다. 표준편차를 알아야 모집단에 '어떤식으.. [통계학입문] 정규분포 , 가설검정, 구간추정 정규 분포 중 제일 기초인, 표준정규분포 ✔ 평균이 0이고, 편차가 1인 정규분포 ✔ 어떤 관찰값이 평균으로부터 표준편차의 몇 배 만큼 떨어져 있는가의 척도 표준정규분포의 성질 ✔ -1 ~ +1 범위의 데이터 상대도수는 약 0.7 : 평균에서 표준편차 1배 이내 범위의 데이터들이 전체 데이터의 70%에 달한다. ✔ -2 ~ +2 범위의 데이터 상대도수는 약 0.95 : 평균에서 표준편차 1배 이내 범위의 데이터들이 전체 데이터의 95%에 달한다. ⭐ 95%라 하면 , 표준정규분포에서는 표준편차 2배 범위 이내에 대부분의 데이터가 들어가있다고 본다. 일반정규분포 ✔ 자연이나 사회에서 가장 흔히 볼 수 있는 분포(like 키, 동전 던지기) ✔ 정규분포곡선은 좌우 대칭이며 하나의 꼭지를 가짐 ✔ 표준정규분포.. [통계] 표준편차 표준편차란 뭐냐 데이터들이 평균값을 기준으로 얼마나 흩어져 있는지를 알 수 있는 정도 - 몰려있는지, 퍼져있는지 ✔ 표준편차가 크다 = 평균값 기준으로 흩어져 있다 ✔ 표준편차가 작다 = 평균값에 몰려있다 표준편차로 무엇을 알 수 있나? 1. 데이터의 특수성 2. 다른 데이터 세트 비교 기준 1. 데이터 특수성 Q. 우리 회사 월급이 300만원인데 내가 450을 받는다고 치자. 높게 받는 편일까? A. 물론 높게 받는 편이긴한데, 표준편차를 이용하면 "얼마나 높게 받는 편"인지 그 정도를 알 수 있다. 내 월급의 편차는 150만원이라 해보자. 1️⃣ 표준편차가 130일 때 : 평균 월급보다 보통 높은 수준의 월급 2️⃣ 표준편차가 50일 때 : 내 월급은 평균으로부터 표준편차의 약 3배 멀리 떨어져있음 .. [통계] 도수분포표와 히스토그램 그리고 평균값 EDA 에서 가장 많이 쓰이는 단어 "분포" "분포하다"의 개념이 명확히 잡히지 않으면 사실 EDA를 할때 꽤나 애를 먹습니다. 통계와 거리가 먼 사람일 수록 "분포"란 단어는 너무나 먼 단어죠. 제가 그렇구요 ^_^ 그래서 이번에 정리를 해보았습니다. 분포란 뭘까요? 집단에 속한 데이터(like 1학년 2반 학생의 몸무게나 키)는 똑같지 않고 다양하죠. 그 다양한 수치로 타나나는게 분포입니다. 그럼 왜 다양한 수치로 나타날까요? 확실하게 말할 수 없는 것들이 이면에 있기 때문입니다. '불확실성'은 그럼 100% 무작위일까요? 아닙니다. '불확실성' 속에 "고유한 특징"과 "반복" 이 있습니다. 그 분포를 만드는 고유한 특징과 반복을 "분포의 특징"이라고 부릅니다. 그리고 사람들은 그 "분포의 특징"을 .. 이전 1 2 3 4 ··· 6 다음