Rebabel — AI 데일리 글로벌 뉴스

AI 일보

AI 일보 – 2025-05-28(석간)

RLHF/RLAIF의 미래: 무작위/잘못된 보상도 모델 성능을 향상시킬 수 있을까? : Stella Li의 실험에 따르면, 무작위 보상 또는 부정확한 보상으로 Qwen2.5-Math-7B 모델을 훈련했을 때 MATH-500 테스트 세트에서 각각 21%와 25%의 성능 향상을 보여, 실제 보상을 사용했을 때의 28.8% 향상 효과에 근접했습니다. natola
AI 일보

AI 일보 – 2025-05-28(조간)

Omni-R1: 새로운 듀얼 시스템 강화 학습 프레임워크, 전체 모달리티 추론 능력 향상 : Omni-R1은 장시간 비디오-오디오 추론과 픽셀 수준 이해 간의 충돌을 해결하기 위해 혁신적인 듀얼 시스템 아키텍처(글로벌 추론 시스템 + 세부 이해 시스템)를 제안했습니다. 이 프레임워크는 강화 학습(특히 그룹 상대 정책 최적화 GRPO)을 활용하여 글로벌 추론
AI 일보

AI 일보 – 2025-05-27(석간)

AMD와 NVIDIA의 AI 추론 분야 성능 경쟁 논란: SemiAnalysis는 SGLang이 AMD ROCm 플랫폼에서 테스트 문제가 있다고 지적했습니다. 예를 들어 실패한 테스트 삭제, 통과 기준 완화 등이 있으며 MI325X CI가 비활성화되었다는 의혹도 제기했습니다. Anush Elangovan(AMD)은 최신 SGLang에서 MI300X와 H20
AI 일보

AI 일보 – 2025-05-27(조간)

DeepSeek-V3-0526 모델 출시 예정, GPT-4.5 및 Claude 4 Opus와 경쟁: 커뮤니티 소식에 따르면, DeepSeek(深度寻求)이 V3 모델의 최신 업데이트 버전인 DeepSeek-V3-0526을 곧 출시할 것으로 보입니다. Unsloth 문서 페이지 정보에 따르면, 이 모델은 GPT-4.5 및 Claude 4 Opus와 동등한 성능
AI 일보

AI 일보 – 2025-05-26(석간)

Google 창립자 Sergey Brin, Gemini의 강력한 성능 비결과 AI 미래 해석: Google 창립자 Sergey Brin이 인터뷰에서 Gemini 모델의 빠른 부상과 그 이면의 기술적 논리를 심층적으로 논의했습니다. 그는 Language Model이 AI 발전의 주요 동력이 되었으며, 그 해석 가능성(예: 사고 모델이 추론 과정을 통찰할 수
AI 일보

AI 일보 – 2025-05-26(조간)

ByteDance, GPT-4o급 이미지 생성 모델 BAGEL 오픈소스 공개: ByteDance가 오픈소스 멀티모달 AI 모델 BAGEL-7B-MoT를 발표했습니다. 이 모델은 이미지 생성, 편집 및 시각적 이해 측면에서 OpenAI GPT-4o에 필적하는 능력을 보여주었습니다. BAGEL은 Mixture of Transformers (MoT) 아키텍처를
AI 일보

AI 일보 – 2025-05-25(석간)

Claude 4 시스템 프롬프트 유출, 복잡한 내부 작동 방식과 윤리적 고려 사항 드러나: Claude 4의 시스템 프롬프트가 유출되어, 사용자 요청 처리의 다양한 모드, (웹 검색과 같은) 도구 사용 규범, 안전 및 윤리적 경계, 유해 콘텐츠 생성 방지 메커니즘 등 내부 명령어 세트를 상세히 공개했습니다. 프롬프트에는 “실행 루프 프롬프트”, “입력 분류
AI 일보

AI 일보 – 2025-05-25(조간)

Anthropic, Claude 4 시리즈 모델 출시, Opus 4는 세계 최강 코딩 모델로 자처: Anthropic이 Claude Opus 4와 Claude Sonnet 4를 공식 출시했습니다. 이 두 모델은 코딩, 고급 추론 및 AI Agent 능력에서 새로운 기준을 세웠습니다. Opus 4는 SWE-bench (72.5%) 및 Terminal-benc
AI 일보

AI 일보 – 2025-05-24(석간)

Anthropic, Claude 4 시리즈 모델 출시, AI 에이전트 프로그래밍 및 복잡한 작업 처리 중점: Anthropic은 Claude Opus 4와 Claude Sonnet 4 두 가지 하이브리드 모델을 출시하여 즉각적인 응답과 심도 있는 사고 간의 균형을 강조했습니다. Opus 4는 코딩, 연구, 글쓰기, 과학적 발견 등 복잡한 작업에서 뛰어난 성