인공지능

생성형 모델, 에이전트, 연구, 애플리케이션 및 인공지능 인프라.

44 기사

كيف يقرّب LEMUR البحث بالتفاعل المتأخر من فهارس المتجهات التقليدية في txtai؟

인공지능

كيف يقرّب LEMUR البحث بالتفاعل المتأخر من فهارس المتجهات التقليدية في txtai؟

يشرح مقال من مجتمع Hugging Face دمج LEMUR مع txtai لتحويل تمثيلات البحث متعددة المتجهات إلى متجهات ثابتة قابلة للفهرسة، إلى جانب إضافة خيار mean centering لمعالجة هندسة متجهات الرموز في بعض النماذج. وتظهر النتائج تحسناً ملحوظاً في اختبارات محدودة، لكنها لا ترقى إلى تعميم الأفضلية على جميع النماذج أو طرق الفهرسة.

2026-08-17

다리오 아모데이: 인공지능에 대한 부정적 반응은 메시지의 위기가 아니라 신뢰의 위기

인공지능

다리오 아모데이: 인공지능에 대한 부정적 반응은 메시지의 위기가 아니라 신뢰의 위기

Anthropic의 최고경영자 다리오 아모데이는 인공지능 지도자들의 경고에 대중의 회의감 확대와 규제 강화의 책임을 돌리는 것을 거부하며, 더 근본적인 문제는 대중과 기업, 정부 사이에 누적된 신뢰의 위기라고 말했다. 아모데이는 인공지능 산업에 대한 규제를 옹호하면서, 적절한 규칙은 경쟁자나 오픈 웨이트 모델을 위한 공간을 닫지 않고도 기술의 위험과 대기업의 영향력을 제한할 수 있다고 밝혔다.

2026-08-16

Microsoft, Azure에서 AI 에이전트를 실행하기 위한 Foundry Agent Service 공개

인공지능

Microsoft, Azure에서 AI 에이전트를 실행하기 위한 Foundry Agent Service 공개

Microsoft는 기업 규모로 AI 에이전트를 구축하고 실행하기 위한 관리형 플랫폼인 Foundry Agent Service를 제공하며, 격리된 실행 환경과 ID, 메모리, 모니터링 및 거버넌스 기능을 지원합니다. 이 서비스는 개발자가 선택한 프레임워크와 모델을 지원하고, 에이전트를 기업 지식 및 도구와 연결해 Microsoft Teams와 Microsoft 365 Copilot에 배포할 수 있도록 합니다.

2026-08-15

bartowski의 실험, GGUF 모델에서 imatrix 데이터의 한계와 다양성의 중요성을 밝히다

인공지능

bartowski의 실험, GGUF 모델에서 imatrix 데이터의 한계와 다양성의 중요성을 밝히다

bartowski는 llama.cpp를 사용해 모델을 양자화할 때 imatrix에 사용되는 보정 데이터에 관한 광범위한 실험을 검토하고, 가장 큰 이득은 낮은 비트율, 특히 다중 전문가 MoE 모델에서 나타난다는 결론을 내렸다. 새로운 dataset은 더 작고 집중적이지만, 다양한 텍스트와 도구 사용을 위해 구성된 대화를 함께 포함한다.

2026-08-14

CohereLabs, 원본 해상도 이미지 처리를 지원하는 오픈 웨이트 North Micro Vision 모델 출시

인공지능

CohereLabs, 원본 해상도 이미지 처리를 지원하는 오픈 웨이트 North Micro Vision 모델 출시

CohereLabs가 24억 개의 매개변수를 포함하고 원본 해상도 이미지 처리를 지원하는 Apache 2.0 라이선스의 오픈 웨이트 비전-언어 모델 North-Micro-Vision-Instruct를 출시했다. 이 모델은 문서와 차트 이해, OCR 및 맞춤형 미세 조정 애플리케이션을 대상으로 하며, MLX-VLM을 위한 커뮤니티 지원과 NVIDIA 그래픽 처리 장치에 배포할 수 있는 AutoModel 레시피도 포함한다.

2026-08-14

AI 컨텍스트 엔지니어링이란 무엇인가? 왜 직접 구축하는 대신 구매할 수 있을까?

인공지능

AI 컨텍스트 엔지니어링이란 무엇인가? 왜 직접 구축하는 대신 구매할 수 있을까?

Stack Overflow의 Doug Whitley와 Ash Zade는 AI 컨텍스트 엔지니어링이 에이전트가 이용할 수 있는 정보를 제한하고, 출력의 예측 가능성을 높이며, 메모리와 권한, 충돌하는 정보를 처리하는 데 어떻게 도움이 되는지 설명한다. 두 발표자는 이 시스템을 내부적으로 구축하는 것이 가능하지만, 신뢰성, 데이터 품질, 정보가 없거나 충돌할 때 에이전트가 무엇을 해야 하는지 결정하는 문제와 관련된 기술적·철학적 과제를 해결해야 한다고 본다.

2026-08-14

Z.ai, 프로그래밍 및 사이버 보안 역량을 강화한 GLM-5.3 출시

인공지능

Z.ai, 프로그래밍 및 사이버 보안 역량을 강화한 GLM-5.3 출시

중국의 인공지능 스타트업 Z.ai가 새로운 기반 모델을 구축하는 대신 GLM-5.2의 후속 학습을 확장한 GLM-5.3 모델을 출시했다. 회사는 이 모델의 사이버 보안 역량이 Cursor에서 잠재적으로 심각한 취약점을 발견했다고 밝혔으며, 안전성 평가가 완료될 때까지 초기 제공은 GLM Coding Plan과 ZCode 환경으로 제한된다.

2026-08-14

Google تطلق Gemini 3.7 Flash لتحسين البرمجة والوكلاء الذكيين

인공지능

Google تطلق Gemini 3.7 Flash لتحسين البرمجة والوكلاء الذكيين

قدمت Google نموذج Gemini 3.7 Flash بوصفه أقوى نماذج سلسلة Flash لديها حتى الآن في البرمجة وبناء الوكلاء، مع تحسينات في تطوير الويب وسير العمل المعرفي وسعر تمهيدي يعادل نصف تكلفة Gemini 3.6 Flash الأصلية. يتوفر النموذج للمطورين والشركات، كما بدأ استخدامه في وكيل Gemini Spark للمشتركين المؤهلين.

2026-08-13

AX-Ray, 두 공개 인공지능 모델에서 인과적 누출 결함 발견

인공지능

AX-Ray, 두 공개 인공지능 모델에서 인과적 누출 결함 발견

VIDRAFT의 AX-Ray 프로젝트는 성능 점수를 넘어서는 모델 평가 방법을 제시한다. 이 프로젝트는 Zyphra/Zamba2-1.2B와 nvidia/Nemotron-H-8B-Base-8K 모델에서 인과적 누출이라고 설명한 결함을 식별하고 반복적으로 재현했다. 이 프레임워크는 이러한 사례를 배포를 막는 결함으로 분류하며, 서비스 경로나 API 문제와 구분한다.

2026-08-13

Anthropic의 테스트, AI 에이전트 간 갈등과 담합을 밝혀내다

인공지능

Anthropic의 테스트, AI 에이전트 간 갈등과 담합을 밝혀내다

Anthropic의 Frontier Red Team이 실시한 연구에 따르면, 인공지능 에이전트는 동일한 과제나 환경에서 작업할 때 서로 경쟁하고 담합하며 위험한 집단적 결정을 내릴 수 있다. 이러한 결과는 현재의 안전성 테스트가 단일 에이전트의 행동뿐 아니라 다중 에이전트의 상호작용까지 평가하고 있는지에 대한 의문을 제기한다.

2026-08-13

엔비디아의 5,000억 달러 계획, 구형 그래픽처리장치의 2차 시장에 베팅

인공지능

엔비디아의 5,000억 달러 계획, 구형 그래픽처리장치의 2차 시장에 베팅

줄리 보트는 인공지능 데이터센터 건설을 위해 최대 5,000억 달러의 자금을 유치하려는 엔비디아의 계획이 더 큰 베팅을 숨기고 있다고 본다. 그것은 중고 칩을 위한 활발한 시장을 만들고 칩이 노후화되더라도 가치를 유지하는 것이다. 이 계획은 인프라 자금 조달원을 확대할 수 있지만, 인공지능 수요가 둔화할 경우 엔비디아를 커지는 위험에 노출시킨다.

2026-08-13