AI 일보 – 2025-08-04(석간)
중국 AI 모델 및 에이전트 역량 돌파: 즈푸(智谱) GLM-4.5 모델 출시, MoE 아키텍처 채택하여 에이전트 역량 강화; 알리바바 클라우드 Qwen3 Coder Flash 30B와 즈푸(智谱) GLM 4.5-Air는 성능 면에서 대형 버전에 근접; 알리바바 Wan2.2 모델은 더 광범위한 테마 운동 생성 지원; Cogito 671B 모델은 성능이 뛰어
AI 일보 – 2025-08-04(조간)
AI 수학 증명 능력 돌파: IMO 금메달 및 형식 검증 : 칭화대 동문 양린(杨林)과 황이천(黄溢辰)은 프롬프트 엔지니어링만으로 Gemini 2.5 Pro가 IMO(국제 수학 올림피아드) 금메달 수준에 도달하도록 성공시켰습니다. 2025년 IMO 6개 문제 중 5개를 해결하며, 학계가 제한된 자원으로도 대기업과 어깨를 나란히 할 수 있는 잠재력을 보여주었
AI 일보 – 2025-08-03(석간)
DeepSeek 차세대 기술 사전 공개, 량원펑(梁文锋) 서명 논문 ACL 2025 최우수 논문상 수상 : DeepSeek 팀이 ACL 2025에서 Native Sparse Attention(NSA) 메커니즘으로 최우수 논문상을 수상했습니다. 이 기술은 알고리즘과 하드웨어의 협업 최적화를 통해 장문 텍스트 처리 속도를 11배 향상시키고, 동시에 기존 Ful
AI 일보 – 2025-08-03(조간)
Embodied AI 에이전트 안전 평가 벤치마크 AGENTSAFE 공개 : 베이항 대학교, 중관춘 연구소, 난양공과대학교 등 기관이 공동으로 세계 최초의 Embodied AI 에이전트 안전 평가 벤치마크 AGENTSAFE를 공개했다. 연구에 따르면, GPT-4o와 Grok 같은 최고 수준의 대규모 모델조차 ‘탈옥’되면 로봇에게 커튼에 불을 붙이거나 사람을
AI 일보 – 2025-08-02(석간)
Anthropic, LLM ‘인격 벡터’ 발견 및 새로운 훈련 패러다임 제안: Anthropic의 최신 연구에 따르면, 대규모 언어 모델(LLM)에는 ‘악의적’, ‘아첨’, ‘환각’과 같은 바람직하지 않은 행동과 관련된 특정 신경 활동 패턴이 존재합니다. 연구는 모델 훈련 중 이러한 불량 패턴을 의도적으로 활성화하면, 오히려 모델이 미래에 이러한 유해한 특
AI 일보 – 2025-08-02(조간)
Gemini 2.5 Deep Think IMO 금메달 모델 출시: Google DeepMind가 “병렬 사고” 및 강화 학습 기술을 통해 국제 수학 올림피아드(IMO)에서 금메달 수준의 성능을 달성한 Gemini 2.5 Deep Think 모델을 발표했습니다. 이 모델은 현재 Google AI Ultra 구독 사용자에게 제공되며, 수학자들에게 심층적인 피드
AI 일보 – 2025-08-01(석간)
OpenAI 연구 방향 및 GPT-5 전망 : OpenAI의 수석 과학자 Jakub Pachocki와 연구 책임자 Mark Chen은 인터뷰에서 GPT-5 개발 진행 상황과 AGI에 대한 견해를 밝혔다. 그들은 수학과 프로그래밍이 범용 인공지능의 초석임을 강조하며, 모델이 사람의 개입 없이 독립적으로 문제를 해결하는 시간을 측정하는 핵심 지표로 ‘자율 시간
AI 일보 – 2025-07-31(석간)
OpenAI IMO 금메달 팀, AI 추론 분야에서 돌파구 마련 : OpenAI의 IMO(국제 수학 올림피아드) 금메달 팀이 AI 추론 분야에서 상당한 진전을 이루었으며, 그들의 범용 언어 추론 모델은 수학 증명과 같이 검증하기 어려운 작업에서 뛰어난 성능을 보였습니다. 이 팀은 단 두 달 만에 다중 에이전트 시스템과 정교한 보상 함수 설계를 통해 수학 및
AI 일보 – 2025-07-31(조간)
Meta, 개인 슈퍼 인텔리전스 비전 발표 : Mark Zuckerberg는 Meta의 ‘개인 슈퍼 인텔리전스’에 대한 미래 비전을 공유하며, 모든 사람에게 세계적 수준의 AI assistant, AI creator, AI enterprise interaction tools를 제공할 것이라고 강조했습니다. 이 비전은 AI를 통해 모든 사용자의 역량을 강화하