Rebabel — AI 데일리 글로벌 뉴스

AI 일보

AI 일보 – 2025-06-03(조간)

DeepMind AlphaEvolve, 수학 기록 경신, 인간-기계 협력으로 과학 발전 촉진: DeepMind의 AlphaEvolve가 일주일 만에 18년간 깨지지 않던 수학 기록을 두 번이나 경신하며 광범위한 주목을 받았습니다. Tao ZheXuan은 이를 두고 단순히 ‘승자’와 ‘패자’를 가르는 것이 아니라, 서로 다른 방법들이 어떻게 상호 보완하여 수
AI 일보

AI 일보 – 2025-06-02(조간)

스탠포드 대학교, AI가 인간 전문가를 능가하는 CUDA 커널 생성 가능성 우연히 발견: 스탠포드 대학교 연구팀은 합성 데이터 생성을 통해 커널 생성 모델을 훈련하던 중, AI(o3, Gemini 2.5 Pro)가 생성한 CUDA 커널이 인간 전문가가 최적화한 버전보다 성능이 뛰어남을 우연히 발견했습니다. 이 AI 생성 커널들은 행렬 곱셈, 2D 컨볼루션,
AI 일보

AI 일보 – 2025-06-01(석간)

xAI, Grok 시스템 프롬프트 공개 및 검열 메커니즘 강화: xAI는 최근 자사의 Grok 응답 로봇이 X 플랫폼에서 무단으로 프롬프트가 수정되어 회사 정책과 가치에 위배되는 정치적 발언을 한 사건으로 인해, Grok 시스템 프롬프트를 GitHub에 공개하기로 결정했다고 발표했습니다. 이 조치는 진실을 추구하는 AI로서 Grok의 투명성과 신뢰성을 강화
AI 일보

AI 일보 – 2025-06-01(조간)

스탠퍼드 대학교, AI가 인간 전문가를 능가하는 CUDA 커널 생성 능력 우연히 발견: 스탠퍼드 대학교 연구팀은 커널 생성 모델을 위한 합성 데이터를 만들던 중, AI(OpenAI o3 및 Gemini 2.5 Pro)가 인간 전문가가 수동으로 최적화한 것보다 성능이 우수한 CUDA 커널을 생성할 수 있다는 사실을 우연히 발견했습니다. 이 AI 생성 커널은
AI 일보

AI 일보 – 2025-05-31(석간)

NVIDIA, 미중 시장 사이에서 “줄타기”하는 어려움과 전략: The Information의 심층 보도에 따르면 NVIDIA는 미국과 중국이라는 두 주요 시장 사이에서 어려운 상황에 처해 있습니다. 젠슨 황 CEO는 직접 미국 정계에 로비하여 수출 금지 조치로 인한 압박을 완화하려고 시도했습니다. 중국 시장은 NVIDIA 매출의 14%를 차지하며, H20
AI 일보

AI 일보 – 2025-05-31(조간)

DeepSeek, R1-0528 신규 모델 출시, 성능 대폭 향상으로 관심 집중: DeepSeek이 대규모 언어 모델의 새로운 버전 R1-0528을 출시하여 여러 벤치마크에서 우수한 성과를 거두었으며, 특히 코드 생성(LiveCodeBench), 과학적 추론(GPQA Diamond), 수학 경진대회(AIME 2024) 등 분야에서 현저한 진전을 이루었습니다
AI 일보

AI 일보 – 2025-05-30(석간)

DeepSeek, R1-0528 모델 출시, GPT-4o 및 Gemini 2.5 Pro 성능에 근접하며 오픈소스 1위 등극: DeepSeek-R1-0528은 수학, 프로그래밍, 일반 논리 추론 등 여러 벤치마크 테스트에서 뛰어난 성능을 보였으며, 특히 AIME 2025 테스트에서 정확도가 70%에서 87.5%로 향상되었습니다. 새 버전은 환각율을 현저히 낮
AI 일보

AI 일보 – 2025-05-29(석간)

DeepSeek R1, “작은 업데이트”로 실제로는 큰 도약, 프로그래밍 및 추론 능력 크게 향상: DeepSeek이 R1 추론 모델의 새 버전(0528)을 발표했습니다. 파라미터 수는 6850억 개에 달하는 것으로 알려졌으며, MIT 라이선스를 채택했습니다. 공식적으로는 “작은 업그레이드”라고 밝혔지만, 커뮤니티 실제 테스트 결과 프로그래밍, 수학 및 긴
AI 일보

AI 일보 – 2025-05-29(조간)

LLM+RL 훈련 유효성 의문: 가짜 보상도 모델 추론 능력 향상시켜: 최근 워싱턴 대학교, Allen AI 연구소, 버클리 연구진은 무작위 또는 잘못된 ‘가짜 보상’을 사용하여 Qwen2.5-Math-7B 모델을 훈련해도 MATH-500 등 수학 벤치마크에서 현저한 성능 향상(무작위 보상 21% 향상, 잘못된 보상 25% 향상)을 달성할 수 있으며, 이는