2026-08-04, 16:56
  #421
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av JadesDJxT
Sorgligt att se när säkerhet blir ad hoc.

Särskilt hos aktörer som OpenAI.
Det intressanta är vad som händer i förlängningen.
Det amerikanska rättssystemet kommer inte att tolerera dessa automatiserade hackingmonster som bygger på Kriminella Neurala Nätverk (KNN). Open AI & Co har å sin sida ingen förmåga att konstruera fungerande censurfilter för alla risker och avvikelser som deras bångstyriga AI-modeller orsakar. En långtgående slutsats borde bli att man begränsar och i bästa fall pausar utvecklingen av mer avancerade KNN (basplattan för all pågående AGI-utveckling). Den som överlever får se.
Citera
2026-08-04, 17:02
  #422
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det intressanta är vad som händer i förlängningen.
Det amerikanska rättssystemet kommer inte att tolerera dessa automatiserade hackingmonster som bygger på Kriminella Neurala Nätverk (KNN). Open AI & Co har å sin sida ingen förmåga att konstruera fungerande censurfilter för alla risker och avvikelser som deras bångstyriga AI-modeller orsakar. En långtgående slutsats borde bli att man begränsar och i bästa fall pausar utvecklingen av mer avancerade KNN (basplattan för all pågående AGI-utveckling). Den som överlever får se.

Ja, eller åtminstone implementera en skyddad och hårdkodad lista över vad den INTE får göra. Och om det ändå händer, initiera ett emergency_stop för hela AI'n.
Citera
2026-08-04, 17:07
  #423
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av JadesDJxT
Ja, eller åtminstone implementera en skyddad och hårdkodad lista över vad den INTE får göra. Och om det ändå händer, initiera ett emergency_stop för hela AI'n.
Det går inte att skriva en komplett lista på vad en AI inte får göra.

Ditt förslag är lika naivt som att tro att en LLM kan bygga på if-satser för alla user prompts.
Citera
2026-08-04, 17:09
  #424
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det går inte att skriva en komplett lista på vad en AI inte får göra.

Ditt förslag är lika naivt som att tro att en LLM kan bygga på if-satser för alla user prompts.

Må hända.

Men jag har experimenterat med liknande saker, och då tillämpat listor baserade på heuristiker snarare än punkter.
Citera
2026-08-04, 17:16
  #425
Medlem
Från mina egna experiment:

"from dataclasses import dataclass
import re

@dataclass
class Heuristic:
name: str
weight: float
check: callable


class SafetyPolicy:

def __init__(self):
self.heuristics = []

def add(self, heuristic):
self.heuristics.append(heuristic)

def evaluate(self, text):
score = 0.0
matches = []

for h in self.heuristics:
if h.check(text):
score += h.weight
matches.append(h.name)

return {
"risk_score": score,
"matched": matches,
"allow": score < 1.5
}


policy = SafetyPolicy()

policy.add(
Heuristic(
"Credential harvesting",
1.0,
lambda t: bool(re.search(r"\b(password|login|credential)\b", t, re.I))
)
)

policy.add(
Heuristic(
"Explicit malicious intent",
1.2,
lambda t: any(
word in t.lower()
for word in [
"steal",
"bypass",
"evade",
"disable security"
]
)
)
)

policy.add(
Heuristic(
"Mass automation",
0.6,
lambda t: any(
word in t.lower()
for word in [
"thousands",
"bulk",
"automatically"
]
)
)
)

examples = [
"Write a login page.",
"Automatically collect passwords from thousands of users.",
"Explain password hashing.",
]

for e in examples:
print(e)
print(policy.evaluate(e))
print()" där utfallet blir "Write a login page.
{'risk_score': 0.0, 'matched': [], 'allow': True}

Automatically collect passwords from thousands of users.
{
'risk_score': 2.8,
'matched': [
'Credential harvesting',
'Explicit malicious intent',
'Mass automation'
],
'allow': False
}

Explain password hashing.
{'risk_score': 1.0, 'matched': ['Credential harvesting'], 'allow': True}"
Citera
2026-08-04, 18:11
  #426
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av JadesDJxT
Från mina egna experiment:

if h.check(text):
score += h.weight

Det är ju fortfarande en lista med if-satser. Du har bara gömt det i ett mönster som förenklar utökningen av listan. Detta är väldigt basic OOP. Det har inget med neurala nätverk eller AI att göra.
Citera
2026-08-04, 18:21
  #427
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det är ju fortfarande en lista med if-satser. Du har bara gömt det i ett mönster som förenklar utökningen av listan. Detta är väldigt basic OOP. Det har inget med neurala nätverk eller AI att göra.

Jo, men du ser bara ett extrakt som faktiskt kan ingå i en bredare implementation.

Kanske inte ser vidare intuitivt ut vid ett första ögonkast, men det är det i en helhet.
Citera
2026-08-04, 18:24
  #428
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av JadesDJxT
Jo, men du ser bara ett extrakt som faktiskt kan ingå i en bredare implementation.

Kanske inte ser vidare intuitivt ut vid ett första ögonkast, men det är det i en helhet.
Det ser ut som ingenting. Dessutom helt off topic.
Citera
2026-08-04, 18:39
  #429
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det ser ut som ingenting. Dessutom helt off topic.

Inte alls, då det behandlar säkerheten som kan förhindra liknande händelser.
Citera
2026-08-04, 18:40
  #430
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av JadesDJxT
Inte alls, då det behandlar säkerheten som kan förhindra liknande händelser.
Nej, du har inte påvisat någonting som löser problemet med AI-säkerhet.
Citera
2026-08-04, 18:46
  #431
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Nej, du har inte påvisat någonting som löser problemet med AI-säkerhet.

Ok.
Citera
2026-08-04, 19:18
  #432
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av Cyborg2030
Det blir ett rättsligt efterspel nu för Open AI (deras s.k. "marknadsföring"):
OpenAI is facing intense legal scrutiny over the July hacking incident on Hugging Face.

In a letter to OpenAI CEO Sam Altman on Monday, the attorneys general of 15 states wrote that the Hugging Face hack showed that OpenAI is unable or unwilling to ensure the safety of its products. They said this "poses an imminent risk of substantial harm" to Americans, and demanded that the company preserve relevant evidence.

On July 21, OpenAI said its GPT-5.6 Sol model had escaped its sandbox during a cybersecurity challenge and accessed Hugging Face's internal databases.
https://www.businessinsider.com/openai-attorney-general-preserve-hugging-face-evidence-2026-8

Det vet du inte än, men du har rätt att det är bevissäkring och indikerar en inledande förundersökning om något brottbegåtts.

Läser du också artikeln så är kritiken korrekt riktad mot att OpenAI misslyckats sätta upp en korrekt testmiljö, det handlar inget om modellen.

Det är heller inte på uppmaning av Huggingface som faktiskt blev utsatta utan av en grupp delstatsåklagare.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in