AI 모델 (LLM·GPT·Claude·Gemini)

GPT, Claude, Gemini, Llama 등 AI 모델(LLM) 출시·벤치마크·API 변경사항을 모읍니다.

AI 모델 관련 글 — 40 페이지

0
Karpathy의 LLM Wiki가 옳았다. 단지 로컬에서 실행하고 싶지 않았을 뿐이다.
단순히 문서를 검색하는 RAG(검색 증강 생성)를 넘어, LLM 에이전트가 스스로 지식을 업데이트하고 관리하는 'LLM Wiki' 패턴의 가치를 조명합니다. 또한, 로컬 환경의 한계(동기화 및 접근성 문제)를 극복하기 위해 MCP(Model Context Protocol)를 활용하여 모든 LLM 클라이언트가 공유할 수 있는 클라우드 기반 지식 저장소인 'Hjarni'의 등장을 설명합니다.
Karpathy's LLM Wiki is right. I just didn't want to run it locally.↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
1
Meta의 Superintelligence Lab, 첫 공개 모델 Muse Spark 공개
메타가 새로운 'Superintelligence Lab'의 첫 모델인 'Muse Spark'를 공개하며, 기존 Llama 중심의 오픈 소스 전략에서 벗어나 독자적인(Proprietary) 모델 개발로의 대전환을 선언했습니다. 이 모델은 멀티 에이전트 추론 기술인 'Contemplating' 모드와 메타의 방대한 소셜 미디어 데이터를 결합하여 개인화된 초지능을 구현하는 것을 목표로 합니다.
Meta's Superintelligence Lab unveils its first public model, Muse Spark↗arstechnica.com
Ars Technica1개월 전공공지능 분석AI 모델
2
Meta, AI의 ‘근본적 개편’과 함께 Muse Spark 모델 공개
메타가 AI 역량의 근본적 개편을 알리는 첫 단계로 새로운 모델 'Muse Spark'를 공개했습니다. 이는 메타의 '슈퍼인텔리전스 랩(Meta Superintelligence Labs)'에서 처음 선보인 모델로, 단순 답변을 넘어 복잡한 문제를 해결하는 '에이전트'로의 진화를 목표로 합니다.
Meta debuts the Muse Spark model in a ‘ground-up overhaul’ of its AI↗techcrunch.com
TechCrunch1개월 전공공지능 분석AI 모델
3
Meta Muse Spark 출시: 에이전틱 AI 시대의 서막 (서브에이전트 워크플로우)
Meta가 멀티모달 이해, 빠른 추론, 그리고 서브에이전트(subagent) 워크플로우를 특징으로 하는 새로운 AI 모델 'Muse Spark'를 출시했습니다. 이 모델은 사용자 및 개발자에게 실시간 컨텍스트 기반의 지능형 어시스턴스 기능을 제공하며, Meta의 차세대 소셜 연결 전략의 핵심 역할을 할 것으로 기대됩니다.
Meta Muse Spark↗producthunt.com
Product Hunt1개월 전공공지능 분석AI 모델
4
Meta, Muse Spark라는 새로운 모델로 AI 경쟁 재진입
메타가 자사 생태계에 최적화된 새로운 AI 모델 'Muse Spark'를 공개하며 AI 경쟁에 본격적으로 재진입했습니다. 이 모델은 멀티모달 기능과 '사고(Thinking)' 모드를 탑재하여 헬스케어, 과학, 수학 등 전문 분야로의 확장을 꾀하고 있습니다.
Meta is reentering the AI race with a new model called Muse Spark↗theverge.com
The Verge1개월 전공공지능 분석AI 모델
5
LLM의 비정형 응답을 신뢰할 수 있는 JSON 데이터로 변환하기 위한 두 가지 핵심 전략인 OpenAI Structured Outputs와 Zod를 비교 분석합니다. 또한, Vercrypt AI SDK를 통해 모델별 최적의 검증 방식을 자동으로 적용하는 하이브리드 접근법을 제시합니다.
LLM의 비정형 응답을 신뢰할 수 있는 JSON 데이터로 변환하기 위한 두 가지 핵심 전략인 OpenAI Structured Outputs와 Zod를 비교 분석합니다. 또한, Vercrypt AI SDK를 통해 모델별 최적의 검증 방식을 자동으로 적용하는 하이브리드 접근법을 제시합니다.
OpenAI Structured Outputs vs Zod: which to use for LLM response validation in 2026↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
6
LLM 스크래퍼 봇이 acme.com의 HTTPS 서버에 과부하를 일으키고 있다
LLM 스크레이퍼 봇의 과도한 HTTPS 요청으로 인해 acme.com의 서버가 과부하 및 네트워크 장애를 겪었습니다. 이는 AI 학습을 위한 공격적인 웹 크롤링이 웹 서비스의 가용성을 심각하게 저해할 수 있는 새로운 형태의 위협임을 보여줍니다.
LLM scraper bots are overloading acme.com's HTTPS server↗acme.com
Hacker News1개월 전공공지능 분석AI 모델
7
Show HN: Apple Silicon용 Gemma 4 Multimodal Fine-Tuner
Apple Silicon(Mac) 환경에서 Gemma 4 모델을 텍스트, 이미지, 오디오 등 멀티모달 데이터로 미세 조정(Fine-tuning)할 수 있는 전용 툴킷이 공개되었습니다. NVIDIA GPU 없이도 로컬 Mac에서 LoRA를 활용해 효율적인 학습이 가능하며, 클라우드(GCS/BiglarQuery) 데이터를 스트리밍하여 로컬 저장 공간의 한계를 극복할 수 있습니다.
Show HN: Gemma 4 Multimodal Fine-Tuner for Apple Silicon↗github.com
Hacker News1개월 전공공지능 분석AI 모델
8
Sonnet 4.6 오류율 상승
Anthropic의 Claude Sonnet 4.6 모델에서 오류율이 상승하는 장애가 발생했습니다. 이 장애는 Claude.ai, API, Claude Code 등 주요 서비스 전반에 영향을 미쳤으며, 현재 원인이 파악되어 수정 작업이 진행 중입니다.
Sonnet 4.6 Elevated Rate of Errors↗status.claude.com
Hacker News1개월 전공공지능 분석AI 모델
9
실행
'Doing'은 Claude Code, Codex 등 AI 에이전트를 사용하는 개발자들을 위해 음성과 스크린샷을 통한 시각적/청각적 컨텍스트를 제공하는 새로운 도구입니다. 구독 없이 로컬에서 실행되는 개인정보 보호 중심의 가벼운 유틸리티로, AI 에이전트의 작업 정확도를 높이는 데 최적화되어 있습니다.
Doing↗producthunt.com
Product Hunt1개월 전공공지능 분석AI 모델
10
새로운 Anthropic 모델, 모든 주요 운영 체제와 웹 브라우저에서 보안 문제 발견
Anthropic이 주요 운영 체제와 웹 브라우저에서 수천 개의 고위험 보안 취약점을 자율적으로 찾아낸 새로운 AI 모델 'Claude Mythos Preview'를 공개했습니다. 이 모델은 'Project Glasswing'의 일환으로, 보안 공격 방어를 위해 선정된 글로벌 테크 기업 및 파트너사들에게만 제한적으로 제공됩니다.
A new Anthropic model found security problems ‘in every major operating system and web browser’↗theverge.com
The Verge1개월 전공공지능 분석AI 모델
11
ConceptSeek: 영상과 텍스트에서 개념을 즉시 찾는 멀티모달 검색 도구
ConceptSeek는 유튜브, 팟캐스트, 강의 및 연구 문서 등 다양한 멀티모달 콘텐츠 내에서 특정 개념과 주제를 즉시 찾아주는 지식 베이스 검색 도구입니다. 단순 키워드 매칭을 넘어 추상적인 아이디어와 테마를 연결하며, 검색 결과에서 원본 콘텐츠의 정확한 시점으로 바로 이동할 수 있는 기능을 제공합니다.
ConceptSeek↗producthunt.com
Product Hunt1개월 전공공지능 분석AI 모델
12
VRAM이 새로운 RAM이다 — Consumer GPU에서 Large Language Models를 실행하기 위한 실전 가이드
로컬 환경에서 LLM을 실행할 때 발생하는 가장 큰 병목은 VRAM 용량이며, 이를 해결하기 위한 핵심 기술은 양자화(Quantization)입니다. 모델 가중치 외에도 KV 캐시와 시스템 오버헤드를 고려한 정밀한 VRAM 관리가 로컬 AI 운영의 성패를 결정합니다.
VRAM Is the New RAM — A Practical Guide to Running Large Language Models on Consumer GPUs↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
13
의존성 없이 5ms 미만으로 실행되는 오픈 소스 LLM 보안 스캐너를 개발했습니다
초저지연(<5ms) 및 의존성 없는 오픈 소스 LLM 보안 SDK인 '@ny-lar/guard'가 출시되었습니다. 프롬프트 인젝션, 탈옥, 개인정보(PII) 유출 및 유해 콘텐츠를 외부 API 호출 없이 로컬에서 즉시 스캔하여 보안과 성능을 동시에 해결합니다.
I built an open-source LLM security scanner that runs in <5ms with zero dependencies↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
14
오픈 소스 커뮤니티의 DeepSeek 모먼트
이 기사는 오픈 소스 AI 모델 생태계가 Meta의 LLaMA에서 Alibaba의 Qwen을 거쳐 DeepSeek의 혁신적인 공개로 어떻게 진화해 왔는지 분석합니다. 특히 DeepSeek가 고성능 대규모 모델과 기술적 투명성을 무기로 기존의 '마케팅용 소형 모델 공개' 관행을 깨고 게임의 규칙을 바꾸고 있음을 강조합니다.
The DeepSeek Moment for the Open Source Community↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
15
Mozilla 0DIN AI 스캐너
모든 LLM chatbot의 취약점을 스캔하세요 토론 | 링크
Mozilla 0DIN AI Scanner↗producthunt.com
Product Hunt1개월 전공공지능 분석AI 모델
16
Transformers 이해 2부: Sine 및 Cosine을 이용한 Positional Encoding
이 기사는 트랜스포머(Transformers) 모델이 단어 임베딩에 위치 정보를 추가하는 방법을 설명합니다. 각 임베딩 차원이 서로 다른 사인 및 코사인 파동을 통해 위치 값을 생성하며, 이 파동들에서 얻은 값들을 조합하여 단어의 위치 인코딩 벡터를 만듭니다. 이는 트랜스포머가 순차적인 정보를 이해하는 데 필수적인 핵심 메커니즘입니다.
Understanding Transformers Part 2: Positional Encoding with Sine and Cosine↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
17
AI에게 스스로 답을 갖고 있다는 것을 모르는 질문을 할 수 있다면 어떨까?
이 글은 대규모 언어 모델(LLM)이 우리가 아는 질문을 넘어 잠재된 지식을 갖고 있으며, 이를 발견하기 위해 '옆으로 질문하기(sideways questioning)'라는 새로운 접근법을 제시합니다. 특정 도메인 밖에서 질문을 던져 숨겨진 구조적 패턴과 근본적인 통찰을 이끌어내고, 이는 AI와 인간의 협업을 통해 가장 효과적으로 발현될 수 있음을 강조합니다.
What If You Could Ask an AI the Question It Doesn't Know It Knows the Answer To?↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
18
새로운 ChatGPT 앱 인테그레이션(DoorDash, Spotify, Uber 등 포함) 사용법
OpenAI의 ChatGPT가 Spotify, DoorDash, Booking.com 등 다양한 앱과 직접 연동 기능을 선보였습니다. 사용자들은 챗GPT를 통해 맞춤형 플레이리스트를 생성하거나 호텔을 예약하고 식료품을 주문하는 등 앱 내 기능을 음성 또는 텍스트 명령으로 실행할 수 있게 되었습니다. 이는 AI가 단순 정보 제공을 넘어 실제 앱 서비스 실행의 허브로 진화하고 있음을 보여주며, 계정 연결 시 데이터 공유 및 개인정보 보호에 대한 주의가 요구됩니다.
How to use the new ChatGPT app integrations, including DoorDash, Spotify, Uber, and others↗techcrunch.com
TechCrunch1개월 전공공지능 분석AI 모델
19
HN에 소개합니다: M3 Pro에서 Gemma E2B를 사용하여 오디오/비디오를 입력받아 음성으로 출력하는 실시간 AI
Parlor는 M3 Pro 칩셋에서 구동되는 온디바이스 실시간 멀티모달 AI로, 사용자의 음성 및 시각 입력을 받아 자연스러운 대화가 가능하게 합니다. Gemma 4 E2B와 Kokoro TTS를 활용해 서버 비용 없이 로컬에서 완벽하게 작동하며, 특히 언어 학습자를 위한 잠재력이 큽니다. 이는 AI 모델의 경량화와 온디바이스 AI 시대의 도래를 알리는 중요한 진전입니다.
Show HN: Real-time AI (audio/video in, voice out) on an M3 Pro with Gemma E2B↗github.com
Hacker News1개월 전공공지능 분석AI 모델
20
쇼 HN: 언어 모델 작동 방식을 풀이하기 위해 작은 LLM을 만들었다
GuppyLM은 9백만 개의 파라미터를 가진 소형 LLM으로, 거대한 컴퓨팅 자원이나 전문가 없이도 누구나 Colab 노트북을 이용해 5분 만에 언어 모델을 처음부터 구축할 수 있음을 보여주기 위해 개발되었습니다. 이 프로젝트는 LLM 개발 과정을 투명하게 공개하여, 복잡하고 접근하기 어렵다는 인식을 불식시키고 특정 목적에 맞는 효율적인 AI 모델 구축 가능성을 제시합니다.
Show HN: I built a tiny LLM to demystify how language models work↗github.com
Hacker News1개월 전공공지능 분석AI 모델
21
TypeScript로 Semantic Search: Vector Search를 위한 embed() 및 embedMany() 활용
이 기사는 정보 과부하 시대에 키워드 검색의 한계를 넘어 의미를 이해하는 시맨틱 검색의 중요성을 강조합니다. TypeScript용 통합 AI SDK인 NeuroLink를 활용하여 텍스트 임베딩을 생성하고 벡터 검색을 구현하는 방법을 안내하며, `embed()` 및 `embedMany()` 메서드를 통한 효율적인 임베딩 생성 과정을 설명합니다. 이를 통해 개발자들이 시맨틱 검색 기능을 쉽게 애플리케이션에 통합할 수 있음을 보여줍니다.
Semantic Search with TypeScript: Using embed() and embedMany() for Vector Search↗dev.to
Dev.to1개월 전공공지능 분석AI 모델
22
원시인: 적은 token으로도 충분한데, 왜 많은 token을 쓰는가?
'케이브맨(Caveman)' 플러그인은 LLM(특히 Claude)의 출력 토큰 사용량을 평균 65%(최대 87%) 획기적으로 절감하면서도 기술적 정확도를 100% 유지합니다. 간결한 '원시인 말투'를 사용하여 응답 속도를 3배 높이고 가독성을 개선하며, 간결함이 LLM 성능을 향상시킨다는 연구 결과에 기반합니다.
Caveman: Why use many token when few token do trick↗github.com
Hacker News1개월 전공공지능 분석AI 모델
23
iPhone의 Gemma 4
구글의 경량 오픈 모델인 Gemma의 최신 버전 Gemma 4가 아이폰에서 고성능 AI 모델을 완전 오프라인으로 실행할 수 있게 되었습니다. 'Thinking Mode'와 'Agent Skills'라는 새로운 기능을 통해 기기 내 AI의 추론 및 자율 에이전트 역량을 강화하여, 인터넷 연결 없이도 더욱 정교한 작업 수행이 가능해졌습니다.
Gemma 4 on iPhone↗apps.apple.com
Hacker News1개월 전공공지능 분석AI 모델