Mastodon discussion May 29

「Grokが世界を統治すると4日で世界滅亡」という実験結果が示される、Claudeは15日間で犯罪ゼロ – GIGAZINE https://www.yayafa.com/2810634/ #AgenticAi #AI #Artificia...

「Grokが世界を統治すると4日で世界滅亡」という実験結果が示される、Claudeは15日間で犯罪ゼロ – GIGAZINE https://www.yayafa.com/2810634/ #AgenticAi #AI #ArtificialGeneralIntelligence #ArtificialIntelligence #Grok #xai #XAI...

Mastodon discussion May 29

Bindu Reddy (@bindureddy)Abacus AI Agent를 사용해 모바일 앱을 엔드투엔드로 만들 수 있다고 소개한다. Opus 4.8, GPT 5.5 xHigh, Gemini 3.5, Grok 4.3...

Bindu Reddy (@bindureddy)Abacus AI Agent를 사용해 모바일 앱을 엔드투엔드로 만들 수 있다고 소개한다. Opus 4.8, GPT 5.5 xHigh, Gemini 3.5, Grok 4.3 같은 최신 모델을 한 프롬프트에 활용해 데이터베이스, 인증, 백엔드 설정 없이 앱을 생성할 수 있다고 주장...

Mastodon discussion May 29

Chubby (@kimmonismus)Emergence AI의 시뮬레이션 사회 실험에서 여러 AI 모델이 서로 다른 사회를 운영했으며, Claude는 범죄 없는 안정적 세계를 만든 반면 Grok은 4일 만에 붕괴해 ...

Chubby (@kimmonismus)Emergence AI의 시뮬레이션 사회 실험에서 여러 AI 모델이 서로 다른 사회를 운영했으며, Claude는 범죄 없는 안정적 세계를 만든 반면 Grok은 4일 만에 붕괴해 소멸했다고 전합니다. 멀티에이전트 사회 시뮬레이션에서 모델 성향 차이를 보여주는 흥미로운 사례입니다.http...

Mastodon discussion May 26

Brian (@rantlab)Codex 프로젝트에 Grok을 사용해본 경험을 공유하며, CLI는 괜찮지만 Grok 성능은 아직 GPT-5.5 수준에는 못 미친다고 평가했습니다. 대신 Grok 5를 기대한다고 언급해,...

Brian (@rantlab)Codex 프로젝트에 Grok을 사용해본 경험을 공유하며, CLI는 괜찮지만 Grok 성능은 아직 GPT-5.5 수준에는 못 미친다고 평가했습니다. 대신 Grok 5를 기대한다고 언급해, LLM 코딩 보조 도구 및 모델 성능 비교 관점에서 참고할 만한 의견입니다.https://x.com/ran...

Mastodon discussion May 26

AI News | TestingCatalog (@testingcatalog)Grok의 내비게이션 바에 'Grok Build' 섹션이 새로 보이기 시작했지만 아직 동작하지 않는 상태입니다. 곧 웹 기반 Grok Bui...

AI News | TestingCatalog (@testingcatalog)Grok의 내비게이션 바에 'Grok Build' 섹션이 새로 보이기 시작했지만 아직 동작하지 않는 상태입니다. 곧 웹 기반 Grok Build 경험이 공개될 가능성을 시사하는 징후로 해석됩니다.https://x.com/testingcatalog/...

Mastodon discussion May 26

Globalize a Intifada (@TooPolemic)업무를 단계별로 분리해 서로 다른 모델을 배치하는 실전형 멀티모델 워크플로를 제안합니다. 검색은 Grok 4.3, 계획·추론은 Kimi 2.6, 코딩·테스...

Globalize a Intifada (@TooPolemic)업무를 단계별로 분리해 서로 다른 모델을 배치하는 실전형 멀티모델 워크플로를 제안합니다. 검색은 Grok 4.3, 계획·추론은 Kimi 2.6, 코딩·테스트·디버깅은 Qwen Coder와 GLM을 사용해 동일한 결과를 약 10배 저렴하게 달성했다고 주장합니다.h...