AI 일보 – 2025-05-17(조간)
OpenAI, Codex 연구 프리뷰 버전 발표, ChatGPT에 통합: OpenAI가 클라우드 기반 소프트웨어 엔지니어링 에이전트인 Codex를 출시했습니다. Codex는 대규모 코드베이스를 이해하고, 새로운 기능을 작성하며, 오류를 수정하고, 여러 작업을 병렬로 처리할 수 있습니다. Codex는 o3으로 미세 조정한 codex-1 모델을 기반으로 하며
AI 일보 – 2025-05-16(석간)
Meta 플래그십 AI 모델 “Behemoth” 출시 거듭 지연, 내부 우려와 업계 성찰 촉발: Meta가 당초 4월 출시 예정이었으나 6월로 연기된 플래그십 AI 모델 “Behemoth”의 출시를 가을 또는 그 이후로 다시 연기했습니다. 내부 소식통에 따르면 모델 성능 향상이 기대에 미치지 못해 막대한 AI 투자 방향에 대한 의문이 제기되었으며, AI 제
AI 일보 – 2025-05-16(조간)
DeepMind, AlphaEvolve 출시: Gemini 기반 진화 코딩 에이전트, 알고리즘 발견 촉진 : AlphaEvolve는 Gemini 모델의 창의성과 자동 평가기를 결합하여 진화 프레임워크를 이용해 알고리즘을 최적화합니다. 이는 여러 분야에서 혁신을 이루었는데, 예를 들어 48번의 스칼라 곱셈으로 4x4 복소 행렬 곱셈을 완료하여 Strassen
AI 일보 – 2025-05-15(석간)
Google DeepMind, AI 프로그래밍 에이전트 AlphaEvolve 공개, 알고리즘 자체 진화 및 최적화 구현: Google DeepMind가 AI 프로그래밍 에이전트 AlphaEvolve를 공개했습니다. 이 에이전트는 Gemini 대규모 언어 모델의 창의력과 자동화 평가기를 결합하여 자체적으로 알고리즘을 발견, 최적화 및 반복할 수 있습니다. A
AI 일보 – 2025-05-15(조간)
구글 DeepMind, AlphaEvolve 공개: Gemini 기반 코딩 에이전트, 알고리즘 발견 혁신: 구글 DeepMind가 Gemini 기반 AI 코딩 에이전트 AlphaEvolve를 출시했습니다. 이는 대규모 언어 모델의 창의성과 자동화된 평가기를 결합하여 복잡한 알고리즘을 발견하고 최적화하는 것을 목표로 합니다. AlphaEvolve는 이미 더
AI 일보 – 2025-05-14(조간)
OpenAI의 HealthBench 벤치마크 발표, AI 의료 능력 대폭 향상: OpenAI가 전 세계 262명의 의사와 협력하여 구축한 의료 AI 평가 벤치마크인 HealthBench를 발표했습니다. 테스트 결과, 최신 AI 모델(예: o3, GPT-4.1)은 의료 대화 시나리오에서 AI 지원을 받은 의사의 최고 수준과 동등한 성능을 보였으며, 독립적인
AI 일보 – 2025-05-13(석간)
OpenAI 수석 과학자 Jakub Pachocki 인터뷰: AI, 5년 내 새로운 과학 자율 발견 가능성, World Model과 Reinforcement Learning이 핵심: OpenAI 수석 과학자 Jakub Pachocki는 Nature지 인터뷰에서 AI가 5년 안에 자율적인 과학 발견을 실현하고 경제에 중대한 영향을 미칠 것으로 기대된다고 밝혔
AI 일보 – 2025-05-13(조간)
OpenAI, 의료 AI 성능 평가 위한 HealthBench 발표: OpenAI는 대규모 언어 모델의 의료 시나리오에서의 성능과 안전성을 측정하기 위한 새로운 벤치마크인 HealthBench를 출시했습니다. 이 벤치마크는 250명 이상의 전 세계 의사가 개발에 참여했으며, 5000개의 실제 의료 대화와 48,562개의 의사가 작성한 고유 평가 기준을 포함