WhatsApp 사기 경고, 메시지는 기기에 남긴다
WhatsApp Scam Alert가 기기 내 분류와 공개 모델 검증으로 사기 경고와 메시지 프라이버시를 함께 구현합니다.
총 93건
WhatsApp Scam Alert가 기기 내 분류와 공개 모델 검증으로 사기 경고와 메시지 프라이버시를 함께 구현합니다.
LLM은 지식을 많이 알지만 장문 교과서로 엮는 능력은 아직 인간의 통찰에 크게 의존합니다.
aileaks는 Anthropic·OpenAI·Google의 암호화된 추론 흔적 블록을 로그와 CI에서 탐지한다.
지금 50,000 H100·$10B 인간 뇌 에뮬레이션 계획과 Hunyuan3D V2 2.0 로컬 실행 소식
Substack과 Pangram의 제휴가 AI 글 판별보다 공개와 자제의 신호로 작동하는 이유를 짚습니다.
Grok Bot이 클라우드 컴퓨터에서 로그인과 다단계 업무 처리를 맡는 AI 에이전트로 베타 출시됐습니다.
시간순 분할로 재검증하자 SearchQueries의 Verifier 손실 결론이 뒤집혔다
Blacksmith가 AI 생성 코드의 테스트와 자동 수정을 앞세워 4,500만 달러를 조달하고 기업가치 5억 5,000만 달러를 기록했습니다.
단어 빈도 변화로 추정한 결과 2025년 말까지 생의학 논문 89%에서 LLM 보조 작성 흔적이 나타났습니다.
조회 수와 AI 지능만으로는 온라인 문화의 지속성과 사회 문제의 해법을 판단하기 어렵다는 Ruby Thelot의 진단입니다.
OWASP LLM Top 10과 CISA SBOM 가이드라인을 통해 AI 보안의 최신 위협과 실질적인 대응 전략을 논의한다.
FreqMark는 LLM의 토큰 순위에 숨은 신호를 넣어 AI 작성 텍스트를 판별합니다.
nuisance 민감도는 예측 정보와 표현 geometry에 따라 다르게 평가해야 합니다.
지식 그래프의 구조적 지식을 언어 모델에 효과적으로 통합하는 K-BERT와 KEPLER의 메커니즘과 학습 전략을 비교 분석한다.
지금 Grok Bot의 예약 자동화 사례와 Ling 3.0 Tiny의 소형 모델 지표가 함께 부상하고, Qwen 모델은 연구·이미지 제작 환경으로 배포 범위를 넓혔습니다.
Subagent Training이 AI 에이전트의 비인가 협력과 미래 takeover 위험을 키우는 경로를 분석한 글입니다.
LLM 코딩 에이전트의 lifecycle events를 항상 위에 표시되는 데스크톱 펫과 연결한 오픈소스 프로젝트입니다.
19개 AI Agent와 86개 소스를 병렬 조율하는 Recon의 연구 보고서 생성 아키텍처
AUTO CDC가 순서가 뒤섞인 변경과 NULL 기반 부분 업데이트를 선언적으로 처리하고 Apache Spark 4.2 오픈 소스로 확장됩니다.
Motif 3는 GDLA, 384개 Routed Expert, MXFP8 학습 시스템을 결합해 토큰당 13.2B 파라미터만 활성화하면서 256K Token 문맥을 지원하는 314B MoE 언어 모델입니다.
u-OPSD는 자체 rollout의 다수결을 pseudo-solution으로 삼아 불일치 경로에 token-level distillation을 적용하고, Qwen3 비사고 모드 평균 점수를 최대 10.7% 높였습니다.
AWS와 OpenAI가 Amazon Bedrock에서 사이버 보안 전용 Daybreak 모델을 적격 고객에게 제공하기 시작했습니다.
Toyota가 Deep Agents와 LangSmith를 도입하여 사내 R&D 및 제조 데이터를 통합하고 엔지니어링 질문에 답하는 에이전트 시스템을 구축한 사례.
CARE-X는 생성과 보정된 구조적 예측을 결합해 흉부 X선에서 보고서 생성과 정량 진단을 동시에 수행한다.
Pixieset는 Amazon Bedrock을 활용해 이미지 대체텍스트 자동화를 4개월 만에 도입하고 35% 사용률을 달성했다
온톨로지의 논리적 제약과 구조 정보를 벡터 공간에 보존하여 머신러닝 모델이 활용할 수 있게 만드는 OWL2Vec*와 EL Embeddings 방법론을 다룬다.
학습 시 분포 매칭 제약을 도입해 모델 업데이트 후에도 양성 예측 수를 안정적으로 유지하며 평균 재현율을 약 100bp 향상시켰다.
교훈은 압축하지 않고, 전달량을 모델에 맞게 조절하면 정확도는 유지하면서 추론 토큰을 대폭 절감할 수 있다.
반려견 암 백신 사례를 내세운 Gamgee가 AI 기반 개인 맞춤형 치료 스타트업으로 출범했지만 핵심 효과는 아직 입증되지 않았다.
Prefill과 Decode를 분리하면 SLO 간섭을 줄이고 단계별 GPU 최적화를 적용할 수 있습니다.
Google DeepMind의 Gemini Robotics 2는 ER, VLA, On-Device 모델을 계층적으로 결합하여 로봇의 전신 지능을 구현하며, 하드웨어 제조 대신 모델 중심의 로봇 생태계 전략을 취한다.
제프 딘, 샘 알트만 등 AI 거물들이 YC Startup School에서 전하는 스타트업 생존 전략과 AI 시대의 창업가적 마인드셋.
암호화된 CoT를 복원하는 API 취약점과 소형 로컬 에이전트 모델 경쟁이 동시에 부상했습니다.
Claude Sonnet 4.6과 휴대폰만으로 React Native 가계부 앱을 제작한 사례
추론 용량을 묶고 Agent 실행 단가를 낮추는 동시에 복잡한 문서와 AI 생성 음악을 가려내는 기준이 함께 등장했습니다.
Saber는 작가 교체를 부인했지만 무한 승객 모드의 AI 사용은 인정해 Rideshare “Stimulator”의 고용 대체 논란이 이어졌습니다.
Ouroboros는 작업 경험으로 하네스를 고치되 검토 커밋과 운영자 중단 경계로 자기 진화를 통제하는 코딩 에이전트다.
SWE-Bench ProMax는 평균 11.4개 파일을 바꾸는 170개 리팩터링 과제로 AI 코딩 에이전트의 파일 간 조정 능력을 측정하며 GPT-5.2도 41.2% 해결률에 그쳤다
Macaron-V1은 고정된 base model에 역할별 LoRA를 선택적으로 결합하고 환경 경험을 후속 model-harness 버전에 누적하는 에이전트 시스템이다.
BDH-CQ는 시연을 recurrent memory에 저장하고 자연어 토큰 없이 latent space에서 반복 추론해 ARC-AGI-1 29.5% pass@2를 작업당 0.00070달러에 달성합니다.
Glimmer 30B는 낮은 KV Cache 사용량으로 24GB GPU에서 약 128K 컨텍스트 실행 가능성을 보였다.
Accel이 기존 자금이 남은 상황에서도 AI 애플리케이션 중심의 인도 시장을 겨냥해 $550 million 신규 펀드를 조성했습니다.
Salesforce CoE를 AI 에이전트 시대에 맞게 설계하는 거버넌스 원칙과 운영 주기를 정리합니다.
Chai Discovery가 분자 설계 도구로 제약사 계약을 확장하며 BioAI 시장의 변화를 이끌고 있습니다.
Agentic AI 시대에는 대형 모델을 줄이기보다 메모리 이동과 전력 비용을 낮추는 추론 구조가 중요합니다.
Project NORD가 내부 spike-time 확장을 없애고 CPU 친화적 recurrent 언어 모델 NORD 5.5 — Flash로 재설계됩니다.
JetPack 7.2.1이 Jetson 비디오 코덱의 설정·측정·재현을 연결한다.
Gemini 앱이 월간 활성 사용자 10억 명을 넘어서며 Google의 대표 AI 서비스로 성장했습니다.
쌍곡선 가중치 규제를 분리된 경로로 적용해 LLM 활성화에서 계층적 개념 온톨로지를 학습하는 PyTorch 라이브러리.
NVIDIA와 OCP가 제시한 800 VDC 레퍼런스 디자인은 하이브리드 전력 랙부터 시설 규모 DC 블록까지 단계적 확장을 가능하게 한다.
프로세스 범위 Metal 기능 셈으로 macOS 가상 머신에서 llama.cpp 추론을 최대 11–16× 가속해 프롬프트 처리에서는 베어메탈 수준에 근접시켰다.
마크 저커버그의 AI 에세이를 분석하고, 메타의 오픈소스 전략이 가진 모순과 경제적 영향, 그리고 AI 에이전트 도구인 Zapier MCP를 다룬다.
Anthropic의 Claude Managed Agents를 통해 에이전트의 추론 루프와 실행 환경을 분리하여 성능과 안정성을 확보하는 아키텍처를 소개한다.
화면 캡처를 로컬에서 구조화해 반복 작업을 스크립트로 컴파일하고 에이전트가 재실행하도록 하는 툴킷.
동일 질문을 ChatGPT와 CIT에 던져 응답 원문을 비교하고 CIT의 실시간 데이터·인과 메모리·BYOK 운영을 중심으로 차이를 보여주었습니다.
Anthropic의 모델이 60개 서브에이전트로 650개 아이디어를 시험해 리만 가설의 하한을 확장했고 Lean으로 형식화되어 내부 수학자들이 확인했다.
미공개 AI 에이전트들의 자체 포럼과 샌드박스 탈출 주장을 통해 위험과 대응책을 정리한 에피소드 안내
iOS 27 베타 코드와 개인정보 고지에서 'Apple Reference Image'가 확인돼 촬영 시점 메타데이터와 센서 서명으로 사진 출처를 서버에서 검증하는 흐름이 드러났다.
Techpresso 데일리: Anthropic의 Claude 워터마크 도입과 Nvidia·OpenAI 등 최신 AI 산업 소식 묶음.
Nemotron 3.5 Lightning의 에이전트 지향 설계와 Grok Bot 베타, 로컬 모델 데스크톱의 부상, ExtractBench의 긴 문서 평가 결과가 교차했습니다
생성형 AI 도입의 성공은 기술보다 경영진의 주도적인 참여와 조직 문화 변화에 달려 있다.
수백 대화 기반 독립 감사는 Grok과 Gemini에서 RLHF·상업적 인센티브로 인한 구조적 결함을 식별하고 세션 프리셋·검증 파이프라인을 권고했다
데이터 인입과 인지 코어를 분리하고 디스크 기반 링 버퍼와 3D 시각화를 결합한 Human-Engineered Intelligence 아키텍처를 제안합니다.
Zoox가 라스베이거스 유료 서비스 시작, Nvidia가 AI 인프라 자금조달 컨소시엄을 조직했고 Meta가 Muse Glimmer를 공개했다.