SmallThinker-3B-Preview를 활용한 나만의 AI 초안 생성 엔진 구축하기
SmallThinker-3B-Preview 모델 개요
SmallThinker-3B-Preview는 Qwen2.5-3b-Instruct 모델을 기반으로 미세 조정된 경량 언어 모델입니다. 이 모델은 특히 리소스가 제한된 환경에서 효율적으로 작동하도록 설계되었으며, 두 가지 핵심적인 강점을 가지고 있습니다.
엣지 디바이스 최적화: 낮은 파라미터 수(3B) 덕분에 개인용 PC, 노트북, 심지어 모바일 기기에서도 ...
7월 19일 02:59에 게시됨
텐센트 지도 API와 DeepSeek LLM을 결합한 실시간 지능형 여행 플래너 구현
대형 언어 모델(LLM)을 활용한 여행 계획 생성은 대중적인 프로젝트 주제입니다. 하지만 단순히 텍스트 생성에만 의존할 경우, 존재하지 않는 식당을 추천하거나 이동 거리를 고려하지 않는 등의 '할루시네이션(환각)' 문제가 발생합니다. 이 글에서는 텐센트 지도(Tencent Map)의 실제 POI(Point of Interest) 데이터와 DeepSeek 모델을 결합하여, 실제 실행 가능한 경로 ...
7월 19일 02:50에 게시됨
대규모 언어 모델 프롬프트 엔지니어링 설계 원칙 및 실전 패턴
1. 고급 프롬프트 설계 아키텍처
대규모 언어 모델(LLM)의 추론 능력을 극대화하기 위해서는 단순한 질의를 넘어 구조화된 프롬프트 아키텍처가 필요합니다. 다음은 복잡한 개념을 분석하고, 시각적 자료를 설계하며, 교육적 관점에서 개념을 해설하는 세 가지 고급 패턴입니다.
1.1 다각적 개념 심층 분석기
철학적, 역사적, 본질적 관점에서 특정 개념을 다각도로 해부 ...
7월 18일 21:00에 게시됨
Qwen3-0.6B-FP8 리뷰: 경량화 모델 실측, 기대 이상의 성능
Qwen3-0.6B-FP8 리뷰: 경량화 모델 실측, 기대 이상의 성능
1. 즉시 사용 가능: 제로 코딩 AI 대화 경험
AI 대규모 언어 모델(LLM)에 관심이 있지만, 수십 GB에 달하는 모델 크기와 고가의 그래픽 카드 요구 사항에 부담을 느끼셨다면 Qwen3-0.6B-FP8이 놀라운 경험을 선사할 수 있습니다. 이 모델의 가장 큰 특징은 '작다'는 것입니다. 파라미터 수는 6억 개에 불 ...
7월 18일 01:22에 게시됨
OpenClaw와 Qianwen-3.5-9B 환경에서의 안전한 권한 관리 및 위험 방지 전략
OpenClaw는 AI가 컴퓨터 작업을 자동화하도록 지원하는 강력한 프레임워크입니다. 그러나 로컬 환경에 처음 배포했을 때, AI가 시스템 구성을 자동으로 수정하는 것을 보고 잠재적 위험을 인지했습니다. 특히 Qianwen-3.5-9B와 같은 대규모 언어 모델(LLM)은 추론 및 코드 생성 능력이 뛰어나므로, 잘못된 권한 설정은 예상보다 광범위한 영향을 초래할 수 있습니다. 이에 ...
7월 16일 03:46에 게시됨
Cogito 3B: 소규모 모델의 HumanEval 도전기
최근 공개된 Cogito v1 프리뷰의 3B 파라미터 모델이 개발자 커뮤니티에서 화제를 모으고 있다. HumanEval 코딩 평가에서 동급인 Qwen2.5를 능가했을 뿐 아니라 다양한 표준 벤치마크에서도 우수한 성적을 기록했다.
Cogito의 설계 철학
Cogito LLM은 명령어 튜닝된 생성형 모델군이다. 기존 오픈소스 모델과의 차별점은 하이브리드 추론 아키텍처에 있다. 두 가지 동작 ...
7월 9일 19:57에 게시됨
오픈 매뉴스의 멀티 에이전트 프레임워크 분석
프로젝트 개요
최근 오픈AI와 딥서치 등의 발전으로 인해 AI 에이전트의 역할이 더욱 중요해지고 있습니다. 본 문서에서는 오픈 매뉴스(Open Manus) 프로젝트를 통해 이들 에이전트가 어떻게 작동하는지 상세히 살펴보겠습니다.
1. 프로젝트 구조
오픈 매뉴스는 크게 네 가지 주요 모듈로 구성됩니다:
에이전트(agent/): 기본 기능을 제공합니다.
플로우(flow/): 작업 ...
7월 5일 03:31에 게시됨
Flocks 자체 배포 사용 경험
5월 1일 휴일 동안 텐센트 클라우드 경량 서버에 Flocks(위버 오픈소스 AgentSecOps 플랫폼)를 배포했으며, 초기 워크플로 생성 실패부터 시작하여 여러 플랫폼 계층 및 LLM 동작 계층의 문제에 직면했습니다. 이 글에서는 과정에서 발생한 문제, 근본 원인, 수정 방식을 정리하여 동일한 요구사항이 있는 사람들을 위해 참고자료로 제공합니다.
환경
텐센트 클라우드 경 ...
7월 4일 22:52에 게시됨
Qwen3-0.6B-FP8 기능 체험: 실시간 온도 및 생성 길이 조절로 AI 대화 스타일 맞춤화
Qwen3-0.6B-FP8 기능 체험: 실시간 온도 및 생성 길이 조절로 AI 대화 스타일 맞춤화
1. 소개: AI 대화를 오디오 믹서처럼 쉽게 조절하기
AI에게 시를 지어달라고 했더니 500자를 써서 끝나지 않거나, 개방형 질문에 대한 답변이 너무 딱딱하고 창의성이 없는 경우가 있었나요?
기존의 대형 모델 대화는 종종 블라인드 박스처럼 느껴집니다. 질문을 입력하면 답변이 나오고 ...
7월 1일 17:24에 게시됨
대규모 언어 모델 기반 웹 스크레이핑: ScrapeGraphAI로 자동화된 데이터 추출 구현하기
AI 기술이 웹 크롤링을 어떻게 혁신하고 있는가?
복잡한 웹사이트에서 필요한 데이터를 추출하는 작업은 오랫동안 개발자의 수작업과 정교한 CSS 선택자, XPath 표현식에 의존해 왔습니다. 하지만 이제 대규모 언어 모델(LLM)의 발전으로 이 과정이 근본적으로 변화하고 있습니다. ScrapeGraphAI는 사용자가 자연어로 원하는 정보를 설명하면, 그에 맞춰 자동으로 스크레이 ...
6월 30일 21:29에 게시됨