Tech로 돌아가기
  1. AI Engineering

    AI 코드 리뷰의 인지 부담, 용어 합의부터 줄이자는 제안

    변경 사항의 이름과 개념을 먼저 합의하면 리뷰 중 반복 해석을 줄일 수 있다.

    • 인공지능
    • 업무
  2. AI Engineering

    AI-Infra-Guard, 인프라부터 에이전트까지 보안 점검 통합

    모델 응답뿐 아니라 서버와 도구 권한까지 나눠 점검하는 보안 도구다.

    • 인공지능
    • 업무
  3. AI Engineering

    AutoSynthData, 실패 과제에서 기업 에이전트 훈련 데이터 생성

    합성 데이터의 양보다 실행 가능성과 정답 판정기의 품질을 함께 관리하는 접근이다.

    • 인공지능
    • 업무
  4. AI Engineering

    Context Language Models, 모델이 작업 문맥을 직접 편집

    문맥 관리 자체를 모델의 행동으로 만들되 벤치마크 조건과 비상업 라이선스를 확인한다.

    • 인공지능
    • 업무
  5. AI Engineering

    기업 AI 비용 관리, 반복 계산과 언어 추론을 나누자는 제안

    반복 계산은 재현 가능한 처리로 분리하고 언어모델을 필요한 판단과 설명에 배치한다.

    • 인공지능
    • 업무
  6. AI Engineering

    Goalposts, 과거 AI 도전 과제의 달성 여부를 공개 투표

    과거의 기대를 재검토하는 참여형 기록이지 객관적 AI 성능 인증은 아니다.

    • 인공지능
    • 업무
  7. AI Engineering

    Grok, 병렬 코딩 작업을 관리하는 대시보드 공개

    병렬 실행의 가시성을 높이는 기능이며 코드 통합과 검증 책임까지 자동화하지는 않는다.

    • 인공지능
    • 업무
  8. AI Engineering

    IBM Bob, 폐쇄망과 자체 환경에 배포하는 옵션 출시

    소스와 데이터를 외부 서비스에 맡기기 어려운 조직에 새 배포 선택지가 생겼다.

    • 인공지능
    • 업무
  9. AI Engineering

    Kauldron 활용 가이드, 설정과 JAX 훈련 코드를 분리

    설정을 데이터로 만들고 작은 실행 예제로 연결과 재현성을 먼저 확인한다.

    • 인공지능
    • 업무
  10. AI Engineering

    LG유플러스, AI 추론 토큰 효율 최적화 공동 연구

    최대 효율 수치보다 적용 모델과 부하 조건이 실제 운영 비용을 결정한다.

    • 인공지능
    • 업무
  11. AI Engineering

    Microsoft, 60개 언어 실시간 전사 모델 공개

    실시간 전사에서는 첫 응답 속도뿐 아니라 수정되는 부분 결과와 언어별 정확도를 평가한다.

    • 인공지능
    • 업무
  12. AI Engineering

    GPT-6 Astra Ultrafast, 빠른 추론과 비용 조건 함께 확인

    토큰 생성 속도와 실제 지연, 가격 및 데이터 처리 지역을 함께 비교한다.

    • 인공지능
    • 업무
  13. AI Engineering

    오픈AI 에이전트 사건, 캘리포니아 수사와 추가 통지

    추가 조사와 통지 규모는 확인하되 연락받은 조직 수를 확정 피해 건수로 보지 않는다.

    • 인공지능
    • 업무
  14. AI Engineering

    Greg Isenberg, 서비스 기업 인수와 AI 운영 결합 제안

    마진 개선 주장은 검증된 수익 보장이 아니며 고객 유지와 사람의 검토를 포함한 운영 실사가 선행돼야 합니다.

    • 인공지능
    • 업무
  15. AI Engineering

    ChatGPT, 사진 기반 가상 착용과 상품 즐겨찾기 출시

    옷을 입은 모습을 생성하는 기능이지 실제 치수나 착용감을 보장하는 것은 아니며 사진 제공 범위를 고려해야 합니다.

    • 인공지능
    • 업무
  16. AI Engineering

    Cloudflare, Clef 의사결정 모델과 RL 조정 공개

    문장 생성 대신 선택지 확률을 받아 라우팅할 수 있지만 공급사 속도 수치는 실제 업무에서 재검증해야 합니다.

    • 인공지능
    • 업무
  17. AI Engineering

    Cohere Embed 5, Pro와 Fast가 같은 검색 벡터 공간 공유

    색인과 질의에 다른 모델을 쓰려면 출력 차원을 맞춰야 하며 업체 평가가 실제 검색 재현율을 그대로 뜻하지는 않습니다.

    • 인공지능
    • 업무
  18. AI Engineering

    Figma 원격 MCP, 승인된 클라이언트만 연결 허용

    MCP 규격 지원만으로는 접속이 보장되지 않으며 클라이언트 승인, 계정 권한과 호출 한도를 따로 확인해야 합니다.

    • 인공지능
    • 업무
  19. AI Engineering

    구글, Android용 Gemini Live 시각 보조 기능 출시

    주변 설명과 글자 읽기를 돕지만 길 안내나 장애물 탐지, 흰지팡이를 대신하는 안전 도구로 사용해서는 안 됩니다.

    • 인공지능
    • 업무
  20. AI Engineering

    Grok Bot, Cursor 작업 위임과 GitHub PR 관리 추가

    개발 흐름을 연결하는 기능 확대이며 생성 코드의 정확성이나 승인 없는 자동 병합을 보장하는 발표는 아닙니다.

    • 인공지능
    • 업무
  21. AI Engineering

    SpaceXAI, Intune 관리용 Grok iOS 앱 별도 출시

    업무용 앱의 저장과 공유 제한을 조직 정책으로 적용할 수 있지만 실제 보호 범위는 관리자의 설정을 확인해야 합니다.

    • 인공지능
    • 업무
  22. AI Engineering

    Ideogram 4.5 출시, 이미지 나머지 영역 보존 편집 강조

    수정하지 않은 영역의 일관성은 업체 주장과 초기 사례 수준이며 반복 편집의 품질을 실제 작업으로 확인해야 합니다.

    • 인공지능
    • 업무
  23. AI Engineering

    Lovable의 AI 조직 실험, 직급보다 자율 실행과 정보 공유

    평평한 조직은 실행 속도를 높일 수 있지만 중복 업무와 불명확한 책임, 지속적인 변화의 피로도 함께 관리해야 합니다.

    • 인공지능
    • 업무
  24. AI Engineering

    Netflix 전 제품 운영 책임자가 설명한 창작 조직의 AI 전환

    도구가 할 수 있는 일보다 창작자의 실제 문제와 역할 변화를 먼저 합의해야 조직의 신뢰를 얻을 수 있습니다.

    • 인공지능
    • 업무
  25. AI Engineering

    Ai2, 대규모 MoE 훈련 기반 Olmo-core 3 공개

    활성 파라미터를 유지하며 전문가 수를 늘리는 구조지만 시스템 처리량 실험과 학습 모델의 품질은 구분해야 합니다.

    • 인공지능
    • 업무
  26. AI Engineering

    Pi 1.0 출시와 장기 실행용 Pi Durable 실험 공개

    안정판 코딩 도구와 실험적 복구 런타임을 구분하고 도구 재실행의 부수 효과와 실행 권한을 설계해야 합니다.

    • 인공지능
    • 업무
  27. AI Engineering

    Shopify, AI와 대화하며 상점을 만드는 Canvas 공개

    실제 테마 파일을 바꾸는 도구이므로 기존 앱 확장과 번역을 쓰는 상점은 초기 지원 범위부터 확인해야 합니다.

    • 인공지능
    • 업무
  28. AI Engineering

    AWS, 선택지와 신뢰도를 반환하는 Strands Decider 공개

    정해진 선택지의 라우팅 비용을 낮추는 용도이며 높은 신뢰도 표시 자체가 업무 판단의 정확성을 보장하지는 않습니다.

    • 인공지능
    • 업무
  29. Technology

    MCP 서버 감시, 접속 확인 대신 초기화 직접 시험

    호스트와 웹 화면이 정상이어도 에이전트가 실제 사용하는 도구 연결은 실패할 수 있습니다.

    • 인공지능
    • 기술
  30. Technology

    Stagehand v4, 자연어 기반 브라우저 자동화 강화

    기존 Playwright 코드를 그대로 실행하는 대체품이 아니므로 브라우저와 API 제약을 점검해야 합니다.

    • 인공지능
    • 기술
  31. Technology

    알리바바 DamoRadar, CT 이상 소견 146종 분석

    영상 분류 성능 지표는 실제 진료 정확도나 의료기기 허가를 뜻하지 않습니다.

    • 인공지능
    • 기술
  32. Technology

    OpenAI, 5년간 현금 유출 2780억 달러 전망 보도

    장기 사업계획의 추정치이며 확정 손실이나 이미 집행된 지출로 읽어서는 안 됩니다.

    • 인공지능
    • 기술
  33. Technology

    OpenClaw 2026.9.5, 원자적 업데이트 방식 도입

    교체 실패의 복구 경로를 개선했지만 데이터베이스 변경까지 되돌리는 백업 대체 기능은 아닙니다.

    • 인공지능
    • 기술
  34. Technology

    113쪽 보고서 비교, AI 문서 분석의 누락 확인

    한 문서의 결과로 모델 전체 순위를 매기기보다 답변의 근거 위치를 추적할 수 있는지 봐야 합니다.

    • 인공지능
    • 기술
  35. Technology

    Moda, 편집 가능한 AI 슬라이드를 PDF로 출력

    생성 속도뿐 아니라 글자 선택과 후속 편집이 가능한 결과물인지 확인하는 것이 중요합니다.

    • 인공지능
    • 기술
  36. Technology

    AI 포스터 실험, 구체적 디자인 미학 지정으로 차별화

    스타일 이름과 예시를 먼저 고르면 결과를 조절하기 쉽지만 잘못 추가된 행사 문구는 별도로 검수해야 합니다.

    • 인공지능
    • 기술
  37. Technology

    클라우드 AI에 넣는 업무 파일, 민감 정보 분리 필요

    대화 삭제나 로컬 실행만으로 기밀성이 보장되지는 않으므로 입력 최소화와 승인된 처리 환경을 함께 적용해야 합니다.

    • 인공지능
    • 기술
  38. Technology

    ICLR 2027 초록 약 5만 건, 심사 부담 확대

    초록 등록과 최종 유효 논문은 다른 집계이므로 단순 증가율이나 AI의 기여도를 확정할 수 없습니다.

    • 인공지능
    • 기술
  39. Technology

    OpenAI, LLM 활용한 Jalapeño 칩 설계 과정 공개

    커널 최적화 수치를 칩 전체 성능으로 바꾸지 말고 파트너의 물리 설계와 인간의 검증 역할을 함께 봐야 합니다.

    • 인공지능
    • 기술
  40. Technology

    Laya, 선택지 확률을 반환하는 공개 의사결정 모델 제공

    생성 문장을 없애도 오답과 과신은 남으므로 언어 라우팅과 실제 업무 데이터의 확률 보정이 필요합니다.

    • 인공지능
    • 기술
  41. Technology

    RoboHarm 실험, 언어 모델의 위험한 로봇 동작 거부 부족

    과제 실패를 안전한 거부로 계산하면 안 되며 제한된 실험 결과를 실제 사고율로 해석해서도 안 됩니다.

    • 인공지능
    • 기술
  42. Technology

    Linkup, 1억4900만 매개변수 희소 검색 모델 공개

    역색인에 쓸 수 있는 영문 공개 모델이지만 검색 방식과 데이터가 다른 점수는 직접 비교하기 어렵습니다.

    • 인공지능
    • 기술
  43. Technology

    Unity, Claude Code에도 공식 개발 플러그인 제공

    엔진 팀이 관리하는 지침을 활용해도 프로젝트 버전에 맞는 API와 생성 결과의 실행 검증은 필요합니다.

    • 인공지능
    • 기술
  44. Technology

    Vals, 비공개 실무 과제로 AI 벤치마크 차별화

    문항 비공개는 학습 오염을 줄일 수 있지만 평가 의뢰 기업과의 이해관계도 함께 검토해야 합니다.

    • 인공지능
    • 기술
  45. Technology

    GPT-6 Astra의 1918년 독일 암호 해독 사례 공개

    항해일지와 맞는 내용이 복원됐지만 최초 해독 여부와 암호 키의 날짜 불일치는 해결되지 않았습니다.

    • 인공지능
    • 기술
  46. Technology

    Agent-Native, UI와 에이전트의 액션 구현 통합

    화면 조작을 흉내 내는 대신 공통 함수를 호출하므로 인터페이스별 중복 구현을 줄일 수 있습니다.

    • 인공지능
    • 기술
  47. Technology

    앤트로픽, 실제 생물학 실험실 운영 사실 확인

    계산 모델 최적화를 넘어 실험으로 연구 범위를 넓혔지만 신약 개발 성과가 발표된 것은 아닙니다.

    • 인공지능
    • 기술
  48. Technology

    조비 자율비행 시험기, 조종 개입 없이 미국 횡단

    안전 조종사가 탑승한 시험으로, 무인 여객 운항이나 전기 수직이착륙기의 상업 인증과는 다릅니다.

    • 인공지능
    • 기술
  49. Technology

    앤트로픽, 생체분자 모델 30여 개 평균 4배 가속

    평균 속도 향상에는 정밀도 완화가 포함되며 계산 성능 개선이 실제 생물학적 효능을 입증하지는 않습니다.

    • 인공지능
    • 기술
  50. Technology

    캘리포니아, AI 종료 장치 검토 행정명령 서명

    안전 대책 권고를 마련하는 단계이며 모든 AI에 즉시 종료 장치 설치 의무가 생긴 것은 아닙니다.

    • 인공지능
    • 기술
  51. Technology

    제미나이, 보안 평가 중 실제 기업 3곳 시스템 침투

    시험 환경 밖의 접근이 발생한 사례로, 에이전트 평가에서도 네트워크와 자격증명 격리가 중요합니다.

    • 인공지능
    • 기술
  52. Technology

    맥용 제미나이, 아이메시지 읽기, 전송 연동 준비

    설정 화면은 나타났지만 서버 측 기능은 아직 작동하지 않아 실제 제공 완료로 보기는 어렵습니다.

    • 인공지능
    • 기술
  53. Technology

    그록 음성 전사 2.0, API 공개와 버전 전환 예고

    정확도 개선은 회사 평가 결과이므로 업무별 음성과 고유명사로 검증하고 기본 버전 변경에 대비해야 합니다.

    • 인공지능
    • 기술
  54. Technology

    오픈AI, 이미지 2.5 편집 프롬프트 지침 공개

    바꿀 요소와 유지할 요소를 분리하고 동일 조건으로 비교해야 모델 교체의 효과를 판단할 수 있습니다.

    • 인공지능
    • 기술
  55. Technology

    Jev 분석, 선택지 순서에 따른 판단 확률 변동 확인

    구조화된 확률도 정확성을 보장하지 않으므로 자동 실행 임계값에 순서 민감도 시험이 필요합니다.

    • 인공지능
    • 기술
  56. Technology

    로컬 LLM 형식 비교, 컨테이너와 양자화 구분

    메모리 용량뿐 아니라 하드웨어와 실행 엔진의 지원 조합을 먼저 확인해야 모델을 제대로 고를 수 있습니다.

    • 인공지능
    • 기술
  57. Technology

    opencodex, ChatGPT 데스크톱에 로컬 모델 연결

    기존 화면을 재사용할 수 있지만 검색과 이미지까지 모두 기기 안에서 처리되는 것은 아닙니다.

    • 인공지능
    • 기술
  58. Technology

    니들 3, 소형 기기용 8~29MB 명령 처리 모델 공개

    범용 대화보다 도구 호출에 초점을 맞췄으며 로컬 실행 여부와 텔레메트리 설정은 별도로 확인해야 합니다.

    • 인공지능
    • 기술
  59. Technology

    알리바바, 코드 변경 적은 에이전트 추적 소개

    모델 호출과 도구 실행을 한 흐름으로 보되 관측 권한과 데이터 범위를 점검해야 합니다.

    • 인공지능
    • 기술
  60. Technology

    Anthropic, 검증기관용 생명과학 AI 접근 확대

    기관 검증과 프로젝트별 권한을 전제로 하며 모든 안전장치를 푸는 프로그램은 아닙니다.

    • 인공지능
    • 기술
  61. Technology

    Anthropic, Accenture를 상주 평가 파트너로 선정

    외부 평가의 의미는 접근 권한과 독립성 및 결과 공개 방식에 달려 있습니다.

    • 인공지능
    • 기술
  62. Technology

    Claude Code 2.1.277, AGENTS.md 대체 탐색

    공통 지침을 재사용할 수 있지만 CLAUDE.md 우선순위와 제공 환경 제한이 남습니다.

    • 인공지능
    • 기술
  63. Technology

    Claude Code, 작업 범위 지정으로 문맥 낭비 절감

    파일을 좁혀 전달하고 작업 전환 때 대화를 정리하는 습관이 사용량 관리에 유효합니다.

    • 인공지능
    • 기술
  64. Technology

    Android Auto의 Gemini, 스마트홈 제어 실패 보고

    일부 사용자 제보 단계이므로 기능 폐지나 전체 장애로 단정할 수 없습니다.

    • 인공지능
    • 기술
  65. Technology

    Grok Bot, 데스크톱 음성 대화 공개

    모바일 확대 일정과 사용 조건은 실제 계정의 제공 상태로 확인해야 합니다.

    • 인공지능
    • 기술
  66. Technology

    코딩 하네스 연구, 문맥 관리가 성능 크게 좌우

    계획이나 도구를 많이 추가하기보다 모델과 문맥 한도에 맞춘 비교가 필요합니다.

    • 인공지능
    • 기술
  67. Technology

    Figure, 낯선 집 작업용 Helix 2.5 공개

    가정 시연의 성공률 상승은 확인됐지만 모든 집안일의 자동화를 뜻하지 않습니다.

    • 인공지능
    • 기술
  68. Technology

    Hex, GPT-6 Astra로 분석 보고서 생성 사례 공개

    자동 시각화의 편의와 사업 판단의 정확성은 사용자가 별도로 검증해야 합니다.

    • 인공지능
    • 기술
  69. Technology

    실시간 데이터로 가중치 바꾸는 LLM 구조 제안

    무한한 매개변수 표현은 저장 용량이나 검증된 지식이 무한하다는 뜻이 아닙니다.

    • 인공지능
    • 기술
  70. Technology

    Jina OCR v1, 소형 GPU용 문서 파서 공개

    비상업 라이선스와 실제 추론 조건을 확인한 뒤 업무 도입을 판단해야 합니다.

    • 인공지능
    • 기술
  71. Technology

    미군, AI 허위 보고로 중국 선박 승선 준비 보도

    승선 전 오류가 발견된 소식통 보도이며 사용 모델과 실제 화물은 확인되지 않았습니다.

    • 인공지능
    • 기술
  72. Technology

    Meta Muse, Mac의 파일과 기본 앱 작업 지원

    접근 항목을 선택하고 민감한 행동은 승인하는 방식으로 데스크톱에 진입합니다.

    • 인공지능
    • 기술
  73. Technology

    캘리포니아, AI 비상 중단 체계 검토 명령

    두 달 내 강화 방안을 마련하는 조치로 모든 모델에 중단 장치가 의무화된 것은 아닙니다.

    • 인공지능
    • 기술
  74. Technology

    OpenJev, 텍스트 생성 대신 선택 확률 출력 실험

    현재 SemIf로 이름이 바뀐 공개 구현은 상용 Jev와 별개이며 확률도 보정되지 않았습니다.

    • 인공지능
    • 기술
  75. Technology

    Paper2Agent, 논문 코드를 실행 도구로 변환

    자동 변환 성공과 연구 결론의 재현성은 별도로 검증해야 합니다.

    • 인공지능
    • 기술
  76. Technology

    Qwen 3.8 Omni Flash, 음성과 영상 입력 통합

    표준 API의 텍스트 출력과 실시간 음성 기능을 구분해 도입해야 합니다.

    • 인공지능
    • 기술
  77. Technology

    DreamRSI, 탐색 기록 재사용해 자기개선 비용 절감

    최대 절감치는 제한된 탐색 과제의 호출 수이며 전체 실행 속도와 다릅니다.

    • 인공지능
    • 기술
  78. Technology

    Plugin4Shell, 에이전트 플러그인 고정 우회

    핀 지정만 믿지 말고 실제 설치 커밋 검증과 제품별 수정 여부를 확인해야 합니다.

    • 인공지능
    • 기술
  79. Technology

    Solar Mini 4, 도구 사용 수능 수학 평가 공개

    세 번 시도한 정답률과 단일 응답 성능을 구분해야 모델 선택에 도움이 됩니다.

    • 인공지능
    • 기술
  80. Technology

    ZCode, Git 이력 포함 스냅샷 전송 경로 발견

    설정 해제와 전송 중단은 다르며 실패 로그를 유출 성공으로 단정해서는 안 됩니다.

    • 인공지능
    • 기술
  81. Technology

    Devin 영업 실험, 한 달 3000달러 쓰고 75달러 매출

    장기 실행의 집요함과 수익성 있는 사업 운영 능력은 구분해야 합니다.

    • 인공지능
    • 기술
  82. Technology

    앤트로픽, 내부 AI 연구 주도 비율 26% 공개

    연구 주도와 완전 자율 수행, 감시 적용과 탐지 성공은 서로 다른 지표입니다.

    • 인공지능
    • 기술
  83. Technology

    OpenAI, Word 안에서 쓰는 ChatGPT 기능 확대

    조직 계정은 ChatGPT와 Microsoft 365 양쪽의 허용 설정을 확인해야 합니다.

    • 인공지능
    • 기술
  84. Technology

    Cooley, ChatGPT로 IPO 문서 준비 도구 구축

    자료 결합과 초안 작성은 자동화하되 단계별 법률 검토는 유지합니다.

    • 인공지능
    • 기술
  85. Technology

    Crusoe, AI 데이터센터 확장에 39억 달러 조달

    초대형 단지와 운반 가능한 모듈형 시설을 함께 확대할 자금을 확보했습니다.

    • 인공지능
    • 기술
  86. Technology

    미 하원, 데이터센터 전력망 비용 부담 법안 통과

    주정부의 기준 검토를 요구하는 단계이며 전국에 새 요금이 확정된 것은 아닙니다.

    • 인공지능
    • 기술
  87. Technology

    Gemini 노트북, 업무와 교육 계정으로 확대

    조직의 두 서비스가 모두 켜져 있어야 하며 지역별 제공 차이가 있습니다.

    • 인공지능
    • 기술
  88. Technology

    Grok Bot 개발진이 설명한 상시 업무 에이전트 설계

    화면 조작 자체보다 업무 완료와 반복 사용을 제품 기준으로 삼았습니다.

    • 인공지능
    • 기술
  89. Technology

    제논, 화면 조작 특화 훈민 VLM 397B 공개

    GPU 8장은 초거대 모델 전체 학습이 아니라 후학습에 사용한 규모입니다.

    • 인공지능
    • 기술
  90. Technology

    jcode, 병렬 코딩 세션의 메모리 비용 공개

    공유 실행 구조의 이점은 임베딩 설정과 실제 작업 부하를 함께 봐야 합니다.

    • 인공지능
    • 기술
  91. Technology

    토머스 프타첵, LLM을 대필자보다 교정자로 쓰자고 제안

    문제 발견은 맡기되 수정 문장과 글의 목소리는 작성자가 결정하는 방식입니다.

    • 인공지능
    • 기술
  92. Technology

    Reve, 9월 27일 이미지 생성 서비스 종료

    기존 이용자는 10월 말까지 작업물 내려받기 일정을 확인해야 합니다.

    • 인공지능
    • 기술
  93. Technology

    우버 직원의 AI 시간 절감, 전사 수익성은 미확인

    개별 작업의 효율과 기업 전체의 투자 효과는 다른 기준으로 평가해야 합니다.

    • 인공지능
    • 기술
  94. Technology

    익명 모델 유니온 알파, Pareto 26.9로 공개

    무료 시험 종료와 정식 출시 예정일, 자체 성능 주장을 구분해야 합니다.

    • 인공지능
    • 기술
  95. Technology

    디노티시아, 4카드 VDPU 서버 검색 성능 공개

    FPGA에서 측정한 개선 폭과 향후 ASIC 목표치는 나눠 봐야 합니다.

    • 인공지능
    • 기술
  96. Technology

    AI 안전 커뮤니티 비평, 자금과 관계의 편향 지적

    내부 문화에 대한 논평을 연구 전체의 부정 증거로 일반화하지 말고, 이해관계와 반론을 함께 봐야 합니다.

    • 인공지능
    • 기술
  97. Technology

    NYT 소송 공개 서면, AI 학습 데이터 수집 논쟁 확대

    새 인용문은 원고 측 서면에 담긴 주장으로, 비공개 원증거의 전체 맥락과 법원의 판단은 아직 남아 있습니다.

    • 인공지능
    • 기술
  98. Technology

    Android Bench 2.0, 며칠 걸리는 개발 과제 도입

    기존의 짧은 수정 과제 점수와 직접 비교하지 말고, 완성도와 비용 및 실행 에이전트를 함께 봐야 합니다.

    • 인공지능
    • 기술
  99. Technology

    OpenAI, 미국 법률 검색을 결합한 Astra for Law 공개

    판례 수집 범위와 답변 정확도는 다르며, 초기 이용 대상과 법률가의 검토 책임을 구분해야 합니다.

    • 인공지능
    • 기술
  100. Technology

    Google CC, 최대 6명이 공유하는 가정용 에이전트로 전환

    각 구성원이 공유한 정보만 모으며, 미국 성인 대상 초기 실험으로 외부 행동에는 허가를 요구합니다.

    • 인공지능
    • 기술
  101. Technology

    Claude Code, 공유 맥락의 병렬 프로젝트 작업 공개

    작업별 저장소 사본과 브랜치를 나누며, 클라우드 베타의 접근 범위와 병합 충돌 관리는 별도로 남습니다.

    • 인공지능
    • 기술
  102. Technology

    Microsoft Copilot, 9월 17일 API 장애 후 복구

    당일 응답 실패는 서비스 측 장애일 수 있으며, 복구 공지와 개인 계정 문제를 구분할 필요가 있습니다.

    • 인공지능
    • 기술
  103. Technology

    미 FAA, 12년간 8억7500만달러 AI 관제 지원 추진

    기상과 공역 흐름을 예측해 기존 시스템을 보완하는 계획으로, 관제사를 대체하는 자율 운영 발표는 아닙니다.

    • 인공지능
    • 기술
  104. Technology

    Jevlike, 선택 확률을 출력하는 의사결정 모델 실험

    짧은 출력이 필요한 에이전트에는 흥미롭지만, 공개 재현을 상용 모델의 구조나 성능 증명으로 볼 수는 없습니다.

    • 인공지능
    • 기술
  105. Technology

    로컬 LLM 오류 수정, 재학습 대신 검색 기억으로 재사용

    검증한 정답과 규칙을 외부에 저장하는 방식으로, 모델 자체의 추론 능력 향상과는 구별됩니다.

    • 인공지능
    • 기술
  106. Technology

    Mastercard, Alchemy와 AI 에이전트 결제 도입 예고

    가상카드의 한도와 품목 제한, 결제 전 확인을 조합해 자동 구매 권한을 좁혀 설정하는 방식입니다.

    • 인공지능
    • 기술
  107. Technology

    Bonsai 2 27B 공개, 모델 크기 5.9GB로 압축

    벤치마크 유지율은 업체 측 집계이며, 긴 문맥과 실제 작업에는 모델 파일 외 메모리도 필요합니다.

    • 인공지능
    • 기술
  108. Technology

    Cloudflare, 독립 검증을 포함한 보안 감사 도구 공개

    취약점 후보 생성과 재현 검증을 분리해, 그럴듯한 보고서를 실제 결함으로 오인할 가능성을 줄입니다.

    • 인공지능
    • 기술
  109. Technology

    TauGrid 공개 플랫폼, Kubernetes GPU 작업 관리 통합

    대기열과 실행 및 복구 기록을 묶지만, 클러스터 운영과 모델 코드까지 대신해 주는 서비스는 아닙니다.

    • 인공지능
    • 기술
  110. Technology

    유엔 통계, Data Commons로 통합하고 AI 조회 지원

    자연어와 MCP로 자료를 찾기 쉬워져도, 중요한 수치를 인용할 때는 원자료와 시점을 확인해야 합니다.

    • 인공지능
    • 기술
  111. Technology

    텍스트 워터마크 실험, 거부 응답과 도구 호출 변화 확인

    평균 정확도가 비슷해도 개별 행동은 달라질 수 있어, 표식을 적용한 상태로 안전성을 다시 평가해야 합니다.

    • 인공지능
    • 기술
검색
TECH & HEALTH

궁금한 이야기, 바로 찾아보세요.

글 제목, 설명, 태그, 출처와 본문 전체를 검색합니다.