Woojin Kim's avatar

Woojin Kim

@[email protected]

82 following189 followers

혼자 있고 싶습니다.

Phanpy 클라이언트는 칼럼 뷰로 바꿀 수 있는데 칼럼에 프로필 뷰가 없는 거임. ... 음... 없으면 좀 불편한데 ... 싶어 아쉬워하다가 문득 '아니 서버에 나밖에 없으니 Local이 프로필 뷰랑 똑같잖아?' 라는 생각을 함. ... 그래서 프로필 뷰가 없지만 있음. 평화가 찾아옴. 역시 서버에 나 혼자밖에 없는게 최고다.

80% 축소해도 131기가여서 어차피 느리게 돌 거 SSD에 넣는걸 포기하고 하드에 넣어야 할 것 같음.

https://sns.lemondouble.com/notes/a3kv8ur304

sns.lemondouble.com

geeknews_bot (@geeknews_bot)

**GN⁺: DeepSeek-R1 Dynamic 1.58-bit 모델 실행하기** ------------------------------ - DeepSeek-R1은 OpenAI의 O1 Reasoning 모델과 비교되는 성능을 보이는 오픈소스 모델임 - 원래 720GB의 모델을 131GB로 축소하여 80% 크기 감소를 달성함 - 동적 양자화 기법을 사용하여 일부 레이어는 높은 비트(예: 4bit)로 유지하고 대부분의 MoE(Mixture of Experts) 레이어는 1.58bit로 처리 # 주요... ------------------------------ https://news.hada.io/topic?id=18955&utm_source=googlechat&utm_medium=bot&utm_campaign=1834

GN⁺: DeepSeek-R1 Dynamic 1.58-bit 모델 실행하기
------------------------------
- DeepSeek-R1은 OpenAI의 O1 Reasoning 모델과 비교되는 성능을 보이는 오픈소스 모델임
- 원래 720GB의 모델을 131GB로 축소하여 80% 크기 감소를 달성함
- 동적 양자화 기법을 사용하여 일부 레이어는 높은 비트(예: 4bit)로 유지하고 대부분의 MoE(Mixture of Experts) 레이어는 1.58bit로 처리

# 주요...
------------------------------
https://news.hada.io/topic?id=18955&utm_source=googlechat&utm_medium=bot&utm_campaign=1834

news.hada.io

DeepSeek-R1 Dynamic 1.58-bit 모델 실행하기 | GeekNews

DeepSeek-R1은 OpenAI의 O1 Reasoning 모델과 비교되는 성능을 보이는 오픈소스 모델임원래 720GB의 모델을 131GB로 축소하여 80% 크기 감소를 달성함동적 양자화 기법을 사용하여 일부 레이어는 높은 비트(예: 4bit)로 유지하고 대부분의 MoE(Mixture of Experts) 레이어는 1.58bit로 처리주요 특징최소 사양:

... 양인들이여. 인터페이스 언어와 컨텐츠 언어가 다를 수 있다는 상상을 좀 해라. 같은 사람이 타이핑하며 둘 이상의 언어를 전환할 수 있다는 것도 상상을 좀 해라. 인덱싱을 같은 언어로만 하면 안된다는 걸 좀 상상하라 좀 좀 좀 ㅠㅠ